Baseten Labs, Inc. proporciona a los equipos técnicos una infraestructura para transformar modelos de inteligencia artificial en servicios que puedan utilizar las aplicaciones. Con sede en San Francisco, esta empresa estadounidense interviene principalmente después del entrenamiento: su plataforma se encarga de ejecutar los modelos cuando reciben una solicitud, una operación denominada inferencia. Su objetivo es reducir el trabajo de infraestructura necesario para utilizar la IA en producción, al tiempo que permite a los desarrolladores mantener el control de sus modelos.
De las herramientas de desarrollo a la inferencia
Fundada en 2019, Baseten se creó en torno a un problema recurrente: un modelo que funciona en un entorno de investigación no se convierte automáticamente en un servicio fiable. Su paso a producción requiere gestionar las dependencias de software, los recursos de cómputo, las interfaces y las variaciones del tráfico. La empresa fue reorientando su oferta hacia esta capa de ejecución, a medida que los modelos generativos aumentaban las necesidades de potencia de cálculo.
Esta especialización la sitúa en la intersección entre las plataformas de desarrollo y las infraestructuras en la nube. En lugar de diseñar un asistente para el público general o apostar por un único modelo propietario, Baseten ofrece un entorno para servir distintos modelos, abiertos o desarrollados por sus clientes. Se dirige así a las empresas que integran la IA en sus productos y necesitan controlar sus condiciones de funcionamiento.
Desplegar, acelerar y supervisar los modelos
Accesible a través de baseten.co, la plataforma permite desplegar modelos mediante interfaces de programación de aplicaciones. Gestiona, entre otras cosas, la asignación de recursos, el escalado y la supervisión de los despliegues. Estas funciones buscan absorber las fluctuaciones de la demanda sin obligar a los equipos a construir por sí mismos toda la cadena operativa. Los casos de uso abarcan, entre otros, la generación de texto, el procesamiento de imágenes y las aplicaciones de audio.
Baseten también desarrolla Truss, una herramienta de código abierto que sirve para preparar y empaquetar modelos para su despliegue. Este componente formaliza su código y sus dependencias para facilitar su ejecución en un entorno de producción. La empresa también trabaja en la optimización de los motores de inferencia y del uso de las GPU, con un objetivo concreto: aumentar la capacidad de procesamiento y reducir la latencia sin que se disparen los costes.
¿Y ahora qué?
La expansión de las aplicaciones generativas convierte la inferencia en un ámbito estratégico, pero también muy competitivo. Baseten debe diferenciarse de los grandes proveedores de servicios en la nube, las plataformas especializadas y los servicios ofrecidos directamente por los desarrolladores de modelos. Su propuesta se basa en la combinación de una infraestructura gestionada, optimizaciones técnicas y cierta libertad de elección de modelos.
Los próximos pasos dependerán, en particular, de su capacidad para dar soporte a cargas de trabajo mayores y a arquitecturas que combinen varios modelos. Para sus clientes, los criterios seguirán siendo operativos: disponibilidad, tiempos de respuesta, privacidad de los datos y previsibilidad de los gastos. Estos resultados, más que las meras demostraciones de modelos, determinarán el lugar de Baseten en el ecosistema de la IA.