Base en el ecosistema Hugging Face: lo que significa
La plataforma Baseten se ha convertido oficialmente en uno de los proveedores de inferencias en el Hugging Face Hub. Este es un paso importante para todos los que trabajan con modelos abiertos: ahora puedes lanzarlos directamente desde la página modelo sin desplegar tu propia infraestructura. Anteriormente, tenías que ir a servicios de terceros, copiar claves y configurar manualmente el entorno, ahora el proceso se reduce a unos pocos clics.

Baseten no es sólo alojamiento para LLMs. La plataforma ofrece inferencia sin servidor, formación de modelos y un catálogo de redes neuronales preparadas, desde modelos de lenguaje hasta sistemas de síntesis de discursos. En la etapa inicial, la integración Hugging Face cubre tareas para asistentes conversacionales y generación de texto. Los modelos disponibles de peso abierto incluyen Kimi K3, DeepSeek V4 Flash, GLM-5.2 y otros. Se espera que la lista de escenarios apoyados se amplíe más adelante.
Cómo configurar el despliegue de modelos
Los usuarios tienen dos maneras de acceder al proveedor. El primero es especificar su propia clave de API de Baseten en la configuración de su cuenta en Hugging Face. Luego las solicitudes de las páginas modelo van directamente al servicio, y pagas por ellas según tu plan. El segundo modo está enrutándose a través de la infraestructura Hugging Face. En este caso, no se necesita una clave separada Baseten: la autenticación ocurre a través de su Hugging Face token, y todos los cargos se facturan a su cuenta de plataforma.
Elegir un proveedor es fácil de controlar: puede establecer el orden de preferencias en su configuración personal. Si un modelo está disponible en varios servicios de terceros, Hugging Face los mostrará automáticamente en la página del modelo, ordenados según su configuración. Esto es conveniente cuando desea comparar la velocidad o el costo de diferentes infraestructuras.

Bibliotecas de clientes y marcos de agentes
Los desarrolladores no tendrán que escribir caldera adicional. Baseten ya está disponible a través de SDKs oficiales: el huggingface_hub versión 1.26.1 y superior para Python, así como el @huggingface/inference paquete para JavaScript. Sólo autentique con su Hugging Face token — y las solicitudes a los modelos alojados en Baseten se enrutarán automáticamente.
También hay buenas noticias para esos sistemas de agentes de construcción. Los proveedores de referencia están integrados con arnés de agente populares, incluyendo Pi, OpenCodeHermes Agents y OpenClaw. Esto significa que un modelo en Baseten se puede utilizar en tales herramientas sin escribir módulos de adaptador - la conexión ocurre a través de los medios estándar del marco.
Costo y límites libres
La cuestión del dinero se resuelve de manera diferente dependiendo del modo elegido. Si utiliza su propia clave de proveedor, la facturación está enteramente en el lado Baseten. Al routing a través de Hugging Face, las tarifas estándar del proveedor se aplican sin ninguna marcación de la plataforma. Los acuerdos de participación en los ingresos pueden ser posibles en el futuro, pero por ahora es un plan de pago estándar como tú.
Los usuarios activos obtienen buenos bonos. Los suscriptores Hugging Face PRO reciben $2 al mes en créditos de inferencia: trabajan en diferentes proveedores. Y los usuarios gratis registrados obtienen una pequeña cantidad de inferencia sin cargo, por lo que puede probar la nueva integración sin ninguna inversión inicial.
La aparición de Baseten en la lista de Proveedores de Inferencia hace que el ecosistema Hugging Face sea aún más flexible. Los usuarios obtienen más opciones, y los desarrolladores obtienen menos rutina. Para desplegar LLMs abiertas, ya no necesita ser un experto en DevOps: un par de ajustes son suficientes, y el modelo está en marcha.



