IA privada y modelos de lenguaje on-premise
Modelos de lenguaje que corren en hardware que usted controla, para datos que no tienen por qué estar en la nube de otro. Estela diseña, instala y opera infraestructura privada de IA para empresas en Uruguay y el exterior.
Cuándo tiene sentido
- Documentos sensiblesEstudios jurídicos, finanzas, salud: expedientes, contratos y registros que no pueden enviarse a una API de terceros.
- Normativa y contratosDatos que deben quedar en el país, en el edificio o bajo un acuerdo específico.
- Uso intensivo y constanteSuficiente volumen diario como para que tener el cómputo propio cueste menos que pagar por token.
Qué instalamos
- Cómputo GPUGPUs NVIDIA para inferencia y fine-tuning, dimensionadas según los modelos y la carga.
- Modelos propiosModelos de lenguaje de pesos abiertos servidos dentro de su red, con una API que sus herramientas ya entienden.
- VirtualizaciónVMware vSphere o Proxmox por debajo, bare metal donde la latencia importa.
- Almacenamiento y respaldosStorage rápido para datasets y pesos de modelos, snapshots y restauraciones que efectivamente restauran.
- Acceso y seguridadCifrado, control de acceso y registros de auditoría, para saber quién preguntó qué.
- Híbrido, cuando convieneUn modelo en la nube solo para las tareas donde los números lo justifican, y nunca con datos que deben quedarse en casa.
Cómo trabajamos
- 1. EvaluaciónMiramos las tareas, los datos y las reglas que los rodean, y le decimos si la IA privada vale la pena.
- 2. PilotoPrototipamos el pipeline en nuestro propio servidor GPU, sin enviar sus datos a ningún tercero.
- 3. ImplementaciónLa misma configuración pasa a su hardware o a una máquina dedicada, con monitoreo y redundancia.
- 4. OperaciónLa mantenemos funcionando, actualizada y respaldada. Casi una década de infraestructura es la parte que no se ve.
Tenemos la nuestra
- El servidor GPU de EstelaHardware NVIDIA sobre Proxmox corre los modelos locales que usamos para ingeniería asistida por IA y para prototipar pipelines de clientes. Recomendamos lo que operamos.
Preguntas
- ¿Un modelo privado es tan bueno como ChatGPT?
- Para leer, clasificar, extraer y redactar a partir de sus propios documentos, los modelos de pesos abiertos actuales cumplen bien. Donde no alcanzan, una configuración híbrida envía a un modelo en la nube solo el trabajo que no es sensible.
- ¿Nuestros datos salen de la empresa?
- No. Modelos, pesos, consultas y documentos quedan en su hardware o en una máquina dedicada bajo su control.
- ¿Cuánto cuesta?
- Depende de los modelos, el volumen y si ya tiene hardware. La evaluación le da un número antes de comprometerse a nada.
- ¿Necesitamos un equipo de IT?
- No. Nosotros lo instalamos, monitoreamos y mantenemos. Su equipo lo usa.
¿Tiene datos que no pueden salir de la empresa? Cuéntenos la tarea. Le decimos qué hace falta para operarla de forma privada.
Escríbanos a: hola@este.la