100% OPERATIVO · FLOTA MULTIMODAL VERIFICADA

Matriz de Inferencia & Flota IA Soberana

14 Servidores de Respuestas IA (puertos 5000–5015) ejecutando con Visión Multimodal nativa, descubrimiento dinámico de modelos upstream (NVIDIA NIM, GROQ LPU, OpenRouter), ejecución de herramientas (Tools) y streaming de razonamiento continuo (Thinking Deltas). Compatibilidad total dual OpenAI REST y WebSocket xAI/Hermes.

18/18
Servicios UP
14/14
Multimodal & Vision
0.0 ms
Latencia Promedio
Radar de Salud Local
Puertos IA (5000-5015) 14 ONLINE
Docker Core (OpenWebUI/Honcho/SearX) 19 UP
Autosanación (Port 9095) ACTIVO
Knowledge Hub Index 247 Informes
PORT 5000 ONLINE
Antigravity (AGY)
Binary: /root/.local/bin/agy · Gemini 3.7 Core
Motor soberano del asistente AGY. Extracción multimodal Base64 a temporales, inyección de directorio workspace `/tmp`, omitiendo permisos con `--dangerously-skip-permissions` para ejecución continua.
Visión Píxel CLI Native Reasoning
PORT 5001 ONLINE
OpenCode
Engine: opencode run --auto · Nemotron Free
Generación y ejecución autónoma de código. Ingesta de archivos mediante bandera `-f`, ejecución de scripts locales Python/PIL para análisis pixelar avanzado y respuesta libre de fricción.
Medios `-f` Auto-Code Sandbox PIL
PORT 5002 ONLINE
Kiro CLI
Engine: kiro-cli chat --agent-engine v2 · DeepSeek V3.2
Agente nativo ACP (Agent Client Protocol). Admite `--output-format stream-json`, invocando proactivamente la herramienta `read` de imagen y emitiendo chunks de pensamiento y contenido estructurado.
ACP Read Tool Trust Tools Stream JSON
PORT 5003 ONLINE
Claude Code
Engine: claude CLI · Backend Local Ollama (:11434)
Asistente de ingeniería con acceso directo al sistema operativo. Extrae imágenes a `/tmp/claude_img_*` e inyecta referencias directas para inspección de código y depuración en el host.
File Access Host Shell Ollama Direct
PORT 5004 ONLINE
Codex
Binary: codex exec -i · Stdin Pipeline Anti-E2BIG
Poder de cómputo en sandbox. Inyección nativa de imágenes con `-i`, prompt canalizado por `stdin` evitando el límite de Linux `E2BIG`, y ejecución de herramientas Python y shell con autolimpieza.
Flag `-i` Nativo Sandbox Tools Anti-E2BIG
PORT 5005 ONLINE
Poolside
Binary: pool exec · Laguna S 2.1 Profile
Arquitectura de razonamiento avanzado. Utiliza `--unsafe-auto-allow -o json`, ejecuta scripts PIL para evaluar píxeles y emite deltas continuos de `reasoning_content` en streaming.
Vision PIL Auto-Allow Reasoning Deltas
PORT 5006 ONLINE
Cursor Agent
Binary: agent · JSONL Protocol Fix
Agente operativo integral. Parser JSONL reparado eliminando el bloqueo `status=failed`, emitiendo deltas de `thinking`, ejecutando comandos vivos de fecha/sistema y reconociendo adjuntos.
Media Attach Host Live Thinking Deltas
PORT 5007 ONLINE
Kilo
Binary: kilo CLI · Multi-Engine
Inyección de medios con `-f /tmp/kilo_img_*`, ejecución con bandera `--auto` y esquemas de herramientas estructuradas para orquestación de tareas en segundo plano.
File Attach Auto Mode
PORT 5008 ONLINE
GitHub Copilot
Binary: copilot CLI · Flag --yolo & --allow-all
Inferencia de alta velocidad (2.6s). Desplegado con `--allow-all-paths --add-dir /tmp --allow-all --yolo` para inspección de medios temporales sin restricciones de permisos.
2.6s Vision YOLO Perms Path Access
PORT 5009 ONLINE
Google Gemini
Engine: gemini-cli · Base64 inlineData Nativo
Capacidades multimodales absolutas: ingesta de imágenes, audio, video y PDFs en Base64 directo. Conversión bidireccional de esquemas OpenAI `tools` <-> `functionDeclarations` de Google.
Imagen/Video Audio Direct Function Call
PORT 5012 ONLINE
Grok PWA Bridge
Chromium CDP 9222 · TipTap/ProseMirror + Supervisor
Puente web directo contra Brave PWA. Supervisor singleton antibucles (`grok-pwa-launcher`), compositor ProseMirror con inyección multilínea y renderizado de bloques de código Markdown puro.
Web Realtime Singleton Lock Pure Markdown
PORT 5013 ONLINE
NVIDIA NIM API
Dynamic Discovery (82+ Models) · Nemotron 3 Ultra 550B
Aceleración GPU en la nube oficial de NVIDIA. Detección proactiva de modelos upstream, streaming de razonamiento `delta.reasoning_content`, visión multimodal y función dual REST/WebSocket.
Multimodal Nemotron 550B Dynamic Models Dual WS/REST
PORT 5014 ONLINE
GROQ LPU Inference
Dynamic Discovery (13+ Models) · GPT OSS 20B / Qwen 3.8
Inferencia ultrarrápida LPU (<0.1s de latencia). Streaming de razonamiento nativo, catálogo de modelos en tiempo real, soporte de tools/json_mode y puente dual REST/WebSocket.
Ultra Latency <0.1s Reasoning LPU Multimodal Dual WS/REST
PORT 5015 ONLINE
OpenRouter Meta-Aggregator
Dynamic Discovery (440+ Models) · DeepSeek Flash / Pro
Agregador universal global. Catálogo dinámico de más de 440 modelos, extracción de razonamiento y deltas ``, visión multimodal completa, streaming SSE y WebSocket RFC 6455.
440+ Modelos DeepSeek & Claude Multimodal Dual WS/REST
Consola de Inferencia Rápida & Pruebas en Vivo
⚡ Ping OK 👁️ Test Imagen Píxel 🛠️ Tool Check 🖥️ Sys Uptime
Motor ObjetivoPORT 5000 (Antigravity)
Payload / PromptTEXT / MULTIMODAL
Respuesta del Servidor (Output Stream)LISTO
// Selecciona un puerto y pulsa 'Enviar Inferencia al Puerto' para probar en caliente.