A1 Digital presenta la infraestructura cloud soberana de Exoscale
La compañía de soluciones digitales de cloud, Conectividad, IoT, Redes y Ciberseguridad A1 Digital, recientemente incorporada al mercado español, ha anunciado Dedicated Inference.
Se trata de un nuevo servicio de su nube europea Exoscale que permite a las organizaciones utilizar la inteligencia artificial de forma autónoma y sin dependencia de un único proveedor. Los clientes obtienen acceso a un entorno de IA optimizado y sin servidor con unidades de procesamiento gráfico (GPU) de NVIDIA dedicadas y alojadas en centros de datos europeos, sin tener que gestionar la infraestructura subyacente por sí mismos. Dentro de este entorno conforme con el Reglamento General de Protección de Datos (RGPD), pueden ejecutar el modelo de IA que elijan y ampliar o reducir su capacidad en cualquier momento según sus necesidades.
“Dedicated Inference es ideal para aquellos equipos que desean pasar de la fase de experimentación a la de producción sin tener que construir y operar su propia plataforma de IA”, explica Elisabetta Castiglioni, CEO de A1 Digital. “Nos tomamos muy en serio lo de "Dedicada" en Dedicated Inference: los datos y tokens de los clientes no comparten hardware con otros usuarios de la nube. Esto significa que se benefician de un rendimiento constante y una latencia extremadamente baja. El aislamiento se extiende hasta los registros y la memoria de la GPU, garantizando la máxima protección de los datos”.
Con Dedicated Inference, Exoscale ofrece una gestión completa de la infraestructura, desde el escalado hasta las actualizaciones en segundo plano, y pone a disposición de los desarrolladores una interfaz de programación de aplicaciones (API) familiar y compatible con OpenAI. Dado que todas las operaciones se realizan exclusivamente en centros de datos europeos, el procesamiento de datos está sujeto a las estrictas exigencias tanto del RGPD como de la Nueva Ley Federal de Protección de Datos de Suiza (nLPD), lo que convierte a este servicio en una solución ideal para sectores altamente regulados. La facturación no se basa en el consumo e insumo impredecible de tokens, sino que es transparente y se calcula al segundo en función de los recursos de hardware aprovisionados. Los usuarios también se benefician del rendimiento de las últimas generaciones de GPU de NVIDIA y de una disponibilidad garantizada del 99,95 % según lo definido en el Acuerdo de Nivel de Servicio (SLA).
Los departamentos de TI, científicos de datos o responsables de aplicaciones de negocio pueden seleccionar un modelo de IA en la plataforma de colaboración de IA más utilizada del mundo —Hugging Face— y utilizarlo dentro de su entorno de Dedicated Inference en Exoscale. Solo tienen que hacer referencia al ID del modelo, ya sea un modelo público, restringido o privado de Hugging Face. A continuación, Exoscale crea una instancia del modelo cargado en las GPU de NVIDIA dedicadas y lo pone a disposición del cliente de forma segura a través de una interfaz compatible con OpenAI.
“En Recarta, el modelo de lenguaje de gran tamaño (LLM) es la columna vertebral de nuestra cadena de procesamiento, por lo que la fiabilidad, la seguridad y el control son innegociables”, afirma Géraud de Laval, cofundador de Recarta, empresa líder en extracción y procesamiento de datos digitales para el sector inmobiliario institucional. “Dedicated Inference de Exoscale nos ofrece exactamente eso: un entorno totalmente gestionado, conforme con la normativa de protección de datos y con la escalabilidad que necesitamos, pero sin los riesgos de los recursos compartidos. Sin interferencias de otros usuarios, sin rendimiento impredecible y sin interrupciones forzadas, simplemente una infraestructura estable y observable donde mantenemos el control total sobre nuestros modelos, uso y ciclos de publicación. Para nuestros clientes, esto significa LLM de código abierto sin puertas traseras, un aislamiento férreo de los datos y la tranquilidad de que sus flujos de trabajo críticos no se verán interrumpidos por factores externos”.