Fondée dans l'écosystème du visage de la hic : ce qu'elle signifie
La plate-forme Baseten est officiellement devenue l'un des fournisseurs d'inférence sur le Hugging Face Hub. C'est une étape importante pour tous ceux qui travaillent avec des modèles ouverts : maintenant vous pouvez les lancer directement depuis la page du modèle sans déployer votre propre infrastructure. Auparavant, vous deviez aller à des services tiers, copier des clés et configurer manuellement l'environnement — maintenant le processus est réduit à quelques clics.

Baseten n'est pas seulement l'hébergement pour les LLM. La plateforme offre une inférence sans serveur, une formation aux modèles et un catalogue de réseaux neuronaux prêts à l'emploi — des grands modèles linguistiques aux systèmes de synthèse vocale. Au stade initial, l'intégration Hugging Face couvre les tâches d'assistants conversationnels et de génération de texte. Les modèles ouverts disponibles incluent Kimi K3, DeepSeek V4 Flash, GLM-5.2 et d'autres. La liste des scénarios pris en charge devrait être élargie ultérieurement.
Comment configurer le déploiement du modèle
Les utilisateurs ont deux façons d'accéder au fournisseur. La première est de spécifier votre propre clé API Baseten dans les paramètres de votre compte sur Hugging Face. Ensuite, les demandes des pages modèles vont directement au service, et vous les payez selon votre plan. Le second mode est le routage via l'infrastructure Hugging Face. Dans ce cas, une clé Baseten séparée n'est pas nécessaire : l'authentification se fait via votre jeton Hugging Face, et tous les frais sont facturés sur votre compte plateforme.
Choisir un fournisseur est facile à contrôler : vous pouvez définir l'ordre des préférences dans vos paramètres personnels. Si un modèle est disponible auprès de plusieurs services tiers, Hugging Face les affichera automatiquement sur la page du modèle, triée selon vos paramètres. Ceci est pratique lorsque vous voulez comparer la vitesse ou le coût de différentes infrastructures.

Bibliothèques clientes et cadres d'agents
Les développeurs n'auront pas à écrire de plaque de chaudière supplémentaire. Baseten est déjà disponible via les SDK officiels: huggingface_hub bibliothèque version 1.26.1 et ci-dessus pour Python, ainsi que @huggingface/inference paquet pour JavaScript. Authentifier simplement avec votre jeton Hugging Face — et les demandes aux modèles hébergés sur Baseten seront acheminées automatiquement.
Il y a aussi de bonnes nouvelles pour ces systèmes d'agents de construction. Les fournisseurs d'inférence sont intégrés à des harnais d'agents populaires, notamment : Pi, OpenCode, agents Hermès, et OpenClaw. Cela signifie qu'un modèle sur Baseten peut être utilisé dans de tels outils sans écrire des modules d'adaptateur — la connexion se fait par les moyens standard du framework.
Coût et limites gratuites
La question de l'argent est résolue différemment selon le mode choisi. Si vous utilisez votre propre clé de fournisseur, la facturation est entièrement du côté Baseten. Lors du routage via Hugging Face, les tarifs standard du fournisseur s'appliquent sans aucun balisage de la plateforme. Des accords de partage des revenus pourraient être possibles à l'avenir, mais pour l'instant, c'est un système standard de rémunération.
Les utilisateurs actifs obtiennent de bons bonus. Les abonnés Hugging Face PRO reçoivent 2 $ par mois en crédits d'inférence — ils travaillent entre différents fournisseurs. Et les utilisateurs libres enregistrés obtiennent une petite quantité d'inférence gratuitement, de sorte que vous pouvez essayer la nouvelle intégration sans aucun investissement initial.
L'apparition de Baseten dans la liste des fournisseurs d'inférence rend l'écosystème Hugging Face encore plus flexible. Les utilisateurs obtiennent plus de choix, et les développeurs obtiennent moins de routine. Pour déployer des LLMs ouverts, vous n'avez plus besoin d'être un expert DevOps : quelques réglages suffisent, et le modèle est opérationnel.



