AiST.Ai
aist.ai-box / on-prem · 152-ФЗ

Todo el ecosistema de Ai en un perímetro cerrado, del rack al clúster.

Dentro de BOX ya funcionan los 5 productos y 10 servicios de AiST — Platform, Agent, Gateway, asistentes, RAG, analítica, vision, voice. Desembalar → conectar → funcionar. Sin internet: sus datos nunca salen del perímetro.

  • 100% on-premise
  • 152-ФЗ · ФСТЭК
  • Puesta en marcha en 30 días
  • Hasta 1024 GPU
// qué hay dentro

Dentro de BOX está todo el ecosistema AiST.
En un perímetro cerrado.

No hace falta comprar módulos adicionales, integrar proveedores ni exponer API. Todo lo que vendemos como servicios SaaS independientes ya está instalado en BOX y funciona sin conexión.

AIR-GAPPED · Su centro de datos
// L4 · Productos
AiST Ai Platform
AiST Agent
AiST Gateway
AiST API
White Label
// L3 · Servicios & asistentes
RAG Search
Code Assistant
Doc Assistant
HR Bot
Sales Bot
Analytics
Voice / ASR
Vision
Translate
Summarizer
// L2 · Núcleo (LLM, Vector, Orchestrator)
LLM Engine · vLLM · TensorRT-LLM
Vector DB · Embeddings · Reranker
Kubernetes · Colas · MLOps
RBAC · Audit · Observability
// L1 · Hardware (GPU · NVMe · Network)
H100 / H200
EPYC · Xeon
NVMe 480 TB+
400 Gb/s · NVLink
servicios externos desconectados
// escala

Desde un piloto para 50 usuarios
hasta un centro de datos para retos de gran escala.

01 · BOX Mini

Piloto

2Ude rack

Para un departamento o una empresa mediana. Ejecuta RAG, chat y hasta 3 agentes para 200 empleados.

  • · hasta 50 solicitudes/seg
  • · LLM hasta 14B
  • · 200 usuarios
02 · BOX Pro

Empresa mediana

8Ude rack

El entorno productivo de una compañía. Los 10 servicios, hasta 20 agentes simultáneos, fine-tuning con sus datos.

  • · hasta 500 RPS
  • · LLM hasta 70B
  • · 5 000 usuarios
03 · BOX Enterprise

Corporación

1rack completo

Holding o banco. Georreplicación, multiinquilino, aislamiento de departamentos, SLA del 99.99%.

  • · hasta 5 000 RPS
  • · LLM hasta 405B
  • · 100 000 usuarios
04 · BOX DataCenter

Retos de gran escala

racks

Su propio centro de datos, sus propios modelos, su propio fine-tuning de LLM fundacionales. Una fábrica industrial de inferencia.

  • · hasta 1024 GPU
  • · entrenamiento desde cero
  • · rollout ilimitado
// por qué BOX

Lo que obtienen el CIO, el CISO y el CFO en el primer trimestre.

BOX resuelve a la vez las tres grandes preocupaciones del enterprise: seguridad, control de costes y velocidad de implantación. Sin nube. Sin vendor lock. Sin compromisos.

01 · CIO 30 días

Producción en lugar de proyecto

Stack listo, modelos preconfigurados, escenarios tipo. No un R&D de 18 meses, sino una plataforma operativa en 2 semanas.

02 · CISO 0 bytes

Nada sale al exterior

Perímetro air-gapped. Sin llamadas a internet, sin tokens en logs ajenos. Certificado ФСТЭК, КИИ, 152-ФЗ — incluidos.

03 · CFO ×7.4

ROI en un trimestre

Un solo CapEx en lugar de un OpEx interminable por tokens. El coste total de propiedad es un 60% inferior al de las API en la nube en un horizonte de 24 meses.

// autonomía

Independencia total de servicios de Ai externos.

BOX no es un integrador de API ajenas. Es un stack de Ai autosuficiente que sigue funcionando incluso con la desconexión total de internet.

Modo air-gapped

No realiza ni una sola petición al exterior. Todos los modelos, embeddings y tokenizadores están en local.

Sus propios LLM y embeddings

Modelos open-source y nacionales incluidos. Se sustituyen en una hora, sin reescribir las aplicaciones.

Orquestación autosuficiente

K8s, colas, vector DB, monitorización — todo dentro. No depende de Azure, AWS, Yandex ni Google.

Actualizaciones sin internet

Los deltas llegan en un soporte físico o por un canal dedicado. Cumple los requisitos de КИИ.

// perímetro AiST BOX
Sus datos · nunca salen del perímetro
Sus modelos · funcionan sin internet
Su auditoría · cada petición queda registrada
API externa · desconectada
Nube del proveedor · no se utiliza
Logs de terceros · ninguno
// infraestructura

Una arquitectura sobre la que se puede firmar un SLA.

BOX se entrega como una configuración validada: cada componente está probado en compatibilidad y carga. Documentación completa, esquemas, runbook.

// Compute

GPU
H100 / H200 / A100
CPU
EPYC 9654 · Xeon 8480
RAM
hasta 4 TB / nodo
Interconnect
NVLink · InfiniBand
Pps
hasta 5 000 RPS

// Storage & Net

NVMe
de 96 TB a 4 PB
Vector DB
hasta 10B vectores
Network
400 Gb/s · low-lat
Backup
compatible con S3
HA
active-active

// Software

OS
Astra · RHEL · Ubuntu
Orchestrator
K8s 1.30 · vLLM
LLM
14B → 405B
API
compatible con OpenAI
SLA
99.99% / 24×7
// implantación

30 días desde la firma hasta la primera petición.

01
día 1–7

Sesión de arquitectura

Definimos el tamaño de BOX, los escenarios y los modelos para sus datos.

02
día 8–14

Entrega y montaje

Llevamos el hardware a su centro de datos, lo montamos, lo ponemos a punto y ejecutamos el diagnóstico.

03
día 15–21

Integración

Lo conectamos a AD, CRM y gestión documental. Configuramos RBAC y auditoría.

04
día 22–30

Sign-off

Prueba de carga, usuarios piloto, entrega a producción. SLA activo.

// retos de gran escala

Qué computan nuestros clientes en BOX.

Banca·BOX Enterprise

Scoring de 4M de expedientes de crédito en tiempo real

RAG + Agent en 16 GPU. Decisión sobre la solicitud en 1.8 segundos en lugar de 14 minutos.

  • ×60velocidad
  • −42%FTE
Industria·BOX Pro

Mantenimiento predictivo con 14 000 sensores

Analytic + Vision en 8 GPU. Los fallos se predicen 72 horas antes del evento.

  • −27%paradas
  • +₽340Mal año
Petróleo y gas·BOX DataCenter

Análisis sísmico en 1024 GPU

Fine-tuning propio de un modelo fundacional sobre un petabyte de datos de exploración.

  • ×38velocidad
  • +12yacimientos
// preguntas frecuentes

Lo que conviene saber antes de la compra.

Seis respuestas a las preguntas que plantean todos los CIO, CISO y responsables de compras en la primera reunión.

¿En qué se diferencia BOX de las API de Ai en la nube?

Un perímetro físico en su centro de datos. Los datos no salen del perímetro, no hay vendor lock y el CapEx es fijo en lugar de un OpEx creciente por tokens. En un horizonte de 24 meses, BOX es entre un 50 y un 70% más económico que la nube.

¿Y si necesitamos 10 GPU y más adelante 200?

Todos los tamaños de BOX son compatibles entre sí. Empiece con Mini o Pro y añada nodos a medida que crezca. Las licencias y los escenarios se conservan; no hace falta reinstalar.

¿Se puede trabajar en modo air-gapped?

Sí, es el modo de funcionamiento estándar. Las actualizaciones llegan por un canal protegido o en un soporte físico. Cumple los requisitos de КИИ y ФСТЭК.

¿Qué modelos son compatibles?

Open-source (Llama, Qwen, Mistral, DeepSeek), nacionales (GigaChat, YandexGPT mediante adaptador) y cualquier modelo fine-tuned suyo. Cambiar de modelo lleva una hora, sin modificar las aplicaciones.

¿Qué incluye el SLA?

Soporte 24×7, arquitecto dedicado, tiempo de respuesta desde 15 minutos, disponibilidad objetivo del 99.99% (para Enterprise/DataCenter) y actualizaciones mensuales de modelos y servicios.

¿Se puede comprar solo el hardware sin los servicios?

No, BOX se entrega como una plataforma completa: hardware + software + modelos + soporte. De lo contrario, se pierde la ventaja principal: la puesta en marcha en 14 días.

// next step

Reserve una demo: le mostraremos el servidor en funcionamiento y calcularemos la configuración a su medida.

Cuéntenos sus tareas y su infraestructura. Un ingeniero realizará una demostración en vivo de BOX, seleccionará la configuración y le enviará una comparativa de TCO con la nube.

// al enviar, usted acepta el tratamiento de sus datos personales