Documentación
Ecosystem docs
El ecosistema Futtura es una pila de cinco capas. Cada capa consume la anterior y todas convergen en Futtura OLLM a través de una sola API key.
Futtura OLLM
Private FactoryFábrica privada de modelos. Todo el ecosistema consume estos modelos, skills y paquetes a través de una API key.
Private model factory. The whole ecosystem consumes these models, skills and packages through a single API key.
Models / Skills· Models & Skills
Modelos de lenguaje, habilidades y capacidades modulares entrenadas y empaquetadas internamente.
Language models, skills and modular capabilities trained and packaged in-house.
AI Packages· AI Packages
Paquetes listos para producción que combinan modelos, prompts y dependencias en una sola unidad.
Production-ready bundles combining models, prompts and dependencies into one unit.
Adapters / RAG· Adapters & RAG
Adaptadores de datos y pipelines de retrieval aumentado para conectar conocimiento externo.
Data adapters and retrieval-augmented pipelines to connect external knowledge.
Model Gateway
Model GatewayPunto único de entrada. Enruta, autentica y mide cada solicitud con API key hacia los modelos de Futtura OLLM.
Single entry point. Routes, authenticates and meters every request by API key to Futtura OLLM models.
Enrutamiento· Routing
Enruta solicitudes al modelo y réplica adecuados según carga y latencia.
Routes requests to the right model and replica based on load and latency.
Autenticación· Auth & API Keys
Valida API keys, aplica cuotas y audita el consumo por consumidor.
Validates API keys, enforces quotas and audits per-consumer usage.
Telemetría· Telemetry
Métricas de tokens, latencia y costo en tiempo real para todo el tráfico.
Real-time token, latency and cost metrics across all traffic.
Futtura AI Fabric
AI FabricEl cerebro de planificación. Decide cómo y dónde se despliega cada workload según capacidad, concurrencia y recursos.
The planning brain. Decides how and where each workload deploys based on capacity, concurrency and resources.
Deployment· Deployment
Gestiona el ciclo de vida de despliegue de modelos y servicios en cualquier destino.
Manages the deployment lifecycle of models and services across any target.
Sizing Engine· Sizing Engine
Dimensiona recursos calculando el tamaño óptimo para cada workload.
Sizes resources by computing the optimal footprint for each workload.
- Capacity Model
- Concurrency
- GPU / VRAM
- STT / TTS
- RAG
Cluster Manager· Cluster Manager
Coordina clústeres de cómputo y mantiene la salud de los nodos.
Coordinates compute clusters and maintains node health.
Workload Orchestrator
Workload OrchestratorEjecuta los workloads en Cloud, On-Prem o Híbrido, autoescalando nodos GPU según la demanda.
Runs workloads on Cloud, On-Prem or Hybrid, autoscaling GPU nodes to demand.
Cloud· Cloud (EKS)
Despliegue en la nube sobre EKS con autoescalado de nodos GPU.
Cloud deployment on EKS with GPU node autoscaling.
On-Prem· On-Prem (K8s/KVM)
Despliegue local sobre Kubernetes/KVM con virtualización ligera.
On-prem deployment on Kubernetes/KVM with lightweight virtualization.
Hybrid· Hybrid
Combina Cloud y On-Prem, moviendo workloads según costo, latencia y soberanía.
Combines Cloud and On-Prem, shifting workloads by cost, latency and sovereignty.
Consumidores
ConsumersAplicaciones de producto. Todas consumen Futtura OLLM por API key a través del Model Gateway.
Product applications. All consume Futtura OLLM by API key through the Model Gateway.
Futtura.ai· Futtura.ai
Agentes, voz y CRM con inteligencia integrada.
Agents, voice and CRM with built-in intelligence.
Education· Education
Tutores, avatares y chat para aprendizaje personalizado.
Tutors, avatars and chat for personalized learning.
Health· Health
Triaje médico, documentos y asistentes clínicos.
Medical triage, documents and clinical assistants.
Futtura Services· futturaservices.com
futturaservices.com →Servicios profesionales de implementación, integración y soporte del ecosistema Futtura.
Professional implementation, integration and support services for the Futtura ecosystem.
Una sola API key
One single API key
Todos los consumidores — Futtura.ai, Education, Health y Futtura Services — acceden a los modelos de Futtura OLLM exclusivamente a través del Model Gateway, usando una API key por consumidor. El Gateway se encarga de autenticar, medir cuotas, enrutar y recolectar telemetría.
All consumers reach Futtura OLLM models only through the Model Gateway, using a per-consumer API key. The Gateway authenticates, meters quotas, routes and collects telemetry.