Plataforma de inferencia en la nube que aloja LLM de pesos abiertos con un servicio rápido y de bajo costo.
Ofrece modelos abiertos destacados como Llama y Mixtral a través de una API compatible con OpenAI, y también proporciona ajuste fino (fine-tuning) y clústeres de GPU dedicados.
© 2026 ITBGM