Baseten est maintenant un nouveau fournisseur d'inférence sur Hugging Face: lancez des LLMs ouverts sans serveurs

21 août 202619 vues

Baseten est maintenant disponible comme l'un des fournisseurs d'inférence dans l'écosystème Hugging Face : à travers les pages modèles et les SDK clients, vous pouvez appeler des modèles ouverts, y compris Kimi K3, DeepSeek V4 Flash, et GLM-5.2, pour la génération de chat et de texte. Les utilisateurs peuvent choisir de payer via leur propre clé API Baseten ou via leur solde Hugging Face, avec des prix standard et des crédits mensuels pour les comptes PRO.

Baseten est maintenant un nouveau fournisseur d'inférence sur Hugging Face: lancez des LLMs ouverts sans serveurs

Fondée dans l'écosystème du visage de la hic : ce qu'elle signifie

La plate-forme Baseten est officiellement devenue l'un des fournisseurs d'inférence sur le Hugging Face Hub. C'est une étape importante pour tous ceux qui travaillent avec des modèles ouverts : maintenant vous pouvez les lancer directement depuis la page du modèle sans déployer votre propre infrastructure. Auparavant, vous deviez aller à des services tiers, copier des clés et configurer manuellement l'environnement — maintenant le processus est réduit à quelques clics.

Baseten n'est pas seulement l'hébergement pour les LLM. La plateforme offre une inférence sans serveur, une formation aux modèles et un catalogue de réseaux neuronaux prêts à l'emploi — des grands modèles linguistiques aux systèmes de synthèse vocale. Au stade initial, l'intégration Hugging Face couvre les tâches d'assistants conversationnels et de génération de texte. Les modèles ouverts disponibles incluent Kimi K3, DeepSeek V4 Flash, GLM-5.2 et d'autres. La liste des scénarios pris en charge devrait être élargie ultérieurement.

Comment configurer le déploiement du modèle

Les utilisateurs ont deux façons d'accéder au fournisseur. La première est de spécifier votre propre clé API Baseten dans les paramètres de votre compte sur Hugging Face. Ensuite, les demandes des pages modèles vont directement au service, et vous les payez selon votre plan. Le second mode est le routage via l'infrastructure Hugging Face. Dans ce cas, une clé Baseten séparée n'est pas nécessaire : l'authentification se fait via votre jeton Hugging Face, et tous les frais sont facturés sur votre compte plateforme.

Choisir un fournisseur est facile à contrôler : vous pouvez définir l'ordre des préférences dans vos paramètres personnels. Si un modèle est disponible auprès de plusieurs services tiers, Hugging Face les affichera automatiquement sur la page du modèle, triée selon vos paramètres. Ceci est pratique lorsque vous voulez comparer la vitesse ou le coût de différentes infrastructures.

Bibliothèques clientes et cadres d'agents

Les développeurs n'auront pas à écrire de plaque de chaudière supplémentaire. Baseten est déjà disponible via les SDK officiels: huggingface_hub bibliothèque version 1.26.1 et ci-dessus pour Python, ainsi que @huggingface/inference paquet pour JavaScript. Authentifier simplement avec votre jeton Hugging Face — et les demandes aux modèles hébergés sur Baseten seront acheminées automatiquement.

Il y a aussi de bonnes nouvelles pour ces systèmes d'agents de construction. Les fournisseurs d'inférence sont intégrés à des harnais d'agents populaires, notamment : Pi, OpenCode, agents Hermès, et OpenClaw. Cela signifie qu'un modèle sur Baseten peut être utilisé dans de tels outils sans écrire des modules d'adaptateur — la connexion se fait par les moyens standard du framework.

Coût et limites gratuites

La question de l'argent est résolue différemment selon le mode choisi. Si vous utilisez votre propre clé de fournisseur, la facturation est entièrement du côté Baseten. Lors du routage via Hugging Face, les tarifs standard du fournisseur s'appliquent sans aucun balisage de la plateforme. Des accords de partage des revenus pourraient être possibles à l'avenir, mais pour l'instant, c'est un système standard de rémunération.

Les utilisateurs actifs obtiennent de bons bonus. Les abonnés Hugging Face PRO reçoivent 2 $ par mois en crédits d'inférence — ils travaillent entre différents fournisseurs. Et les utilisateurs libres enregistrés obtiennent une petite quantité d'inférence gratuitement, de sorte que vous pouvez essayer la nouvelle intégration sans aucun investissement initial.

L'apparition de Baseten dans la liste des fournisseurs d'inférence rend l'écosystème Hugging Face encore plus flexible. Les utilisateurs obtiennent plus de choix, et les développeurs obtiennent moins de routine. Pour déployer des LLMs ouverts, vous n'avez plus besoin d'être un expert DevOps : quelques réglages suffisent, et le modèle est opérationnel.

Foire aux questions

Matériaux connexes

Tous matériaux
Fondé dans Hugging Face Examen de l'intégration et des opportunités