Compute & GPU Engine

Roteamento inteligente de workloads entre o Master VPS (24/7) e o GPU Compute Cluster on-demand (L40S/A100). Telemetria, routing e análise de custo em tempo real.

Telemetria dos Nós

Node 1 · Master VPS

4 vCPUs · 24/7 Hostinger

ONLINE
🔀Traefik
🌐Nginx
⚙️n8n
🗄️Supabase DB
Uptime: 00:00:004 vCPUs8 GB RAM

Node 2 · GPU Cluster

L40S / A100 · On-Demand

STANDBY
Custo Horário$0.00/hr
VRAM Utilizada0 / 48 GB

Roteamento de Workloads

Ollama LLM Engine

Inferência Local Multi-Agent

LOCAL

Motor de inferência LLM rodando localmente no VPS para agentes de baixa latência. Processa consultas do Cronos, Kairós e Picoclaw sem custo de API externo.

LocalMulti-AgentZero-Costo
ollama.minaris.ai:11434$0.00/hr
StatusPronto para executar
Endpointollama.minaris.ai:11434
Custo Estimado$0.00/hr

InvokeAI & Render Studio

Ativos Criativos / Fotorrealismo

GPU

Geração de imagens de alta resolução para cards de agentes, thumbnails da Academy e materiais visuais do ecossistema via Stable Diffusion XL.

GPUSDXLCreative
gpu-cluster:7860$0.85/hr
StatusAguardando GPU
Endpointgpu-cluster:7860
Custo Estimado$0.85/hr

Vector Indexer (Qdrant)

Embedding Massivo de Documentos

HYBRID

Indexação vetorial de todos os documentos do ecossistema para retrieval semântico. Alimenta o RAG do Clio e a base de conhecimento do Palantir.

HybridRAGEmbeddings
qdrant:6333$0.12/hr
StatusPronto para executar
Endpointqdrant:6333
Custo Estimado$0.12/hr

Model Fine-Tuning (Unsloth)

Calibração de Tom de Voz

GPU

Fine-tuning de modelos open-source para replicar o tom de voz único da Minaris. Treina agentes com personalidade consistente em 5 idiomas.

GPULoRATraining
gpu-cluster:8000$1.20/hr
StatusAguardando GPU
Endpointgpu-cluster:8000
Custo Estimado$1.20/hr

Painel Sinodal dos Agentes

Cronos · Diagnóstico ROI

API Tokens vs. GPU Credits

Tokens Hoje2.8M
Custo API$8.54
Custo GPU/dia$3.60
Break-Even1.2M
Recomendação: GPUEconomia de ~58% migrando para GPU

Picoclaw · Action Trigger

Batch Payloads via n8n → GPU

Pipelinen8n → Internal API → GPU
Endpointgpu-cluster.internal:8000/batch
GPU Status○ Standby
10250500