ONLINE
Inferencia local + Hyphae Cloud. Conocimiento fresco con autorización por tenant.
HiveMind Runtime
HiveMind es el runtime que convierte un modelo pequeño en un sistema confiable: reglas deterministas primero, propuestas neuronales acotadas después, verificación independiente siempre.
Arquitectura
Una tarea recorre un solo camino. Cada frontera es dueña de exactamente una cosa, y ninguna confía en la etapa anterior.
Modos de ejecución
El mismo ciclo gobernado corre en distintas posturas de privacidad. Las credenciales se resuelven en runtime desde el llavero del sistema — nunca desde prompts, pesos ni archivos de configuración.
Inferencia local + Hyphae Cloud. Conocimiento fresco con autorización por tenant.
Inferencia local + caché offline verificada. Respuestas útiles con pruebas, sin red.
Inferencia local + Hyphae local o privado. Nada sale de la máquina. Apto para air-gap.
Sin lecturas ni escrituras de memoria personal. Una sesión que por diseño no deja rastro.
Contexto virtualizado
MARS no promete contexto infinito. Ofrece acceso reanudable a memoria durable: un working set pequeño, recuperación iterativa, citas explícitas y estado de tarea con checkpoints.
16K
Política, estado de la tarea, diálogo reciente, evidencia top-k, reserva de salida — todo lo que necesita un paso acotado.
32K
Para pasos genuinamente amplios, con contabilidad explícita de presupuesto y sin truncamiento silencioso.
128K
La capacidad física completa, reservada para auditorías. La calidad del contexto se mide por recall de evidencia — no por longitud publicitada.
128K es capacidad física, no una promesa de comprensión. Las tareas largas guardan checkpoints de afirmaciones verificadas e IDs de fuente — no hacen crecer el prompt para siempre.
Carril de maestros
Los modelos grandes en GPU actúan como maestros y servicio de escalación. Sus salidas cruzan el mismo verificador y la misma frontera de política que todo lo demás.
API local-first
El backend solo se liga a 127.0.0.1 y habla un contrato OpenAPI 3.1 estable. Cualquier frontend profesional integra contra estos ocho endpoints — mensajes al usuario en inglés y español.
/v1/health Vida del runtime local /v1/runtime Identidad del runtime: SHA-256 del artefacto, postura, idiomas /v1/knowledge/inspect Previsualizar un documento antes de ingerirlo — digest, tamaño, avisos /v1/knowledge/commit Ingerir un documento al plano de conocimiento local /v1/knowledge/sources Inventario de fuentes con digests de contenido /v1/knowledge/sources/{digest} Eliminar una fuente exacta contenido-direccionada /v1/chat Pregunta gobernada → decisión, respuesta, fuentes, canales, id de recibo /v1/receipts/{id} Obtener el recibo canónico de cualquier respuesta Solo loopback por diseño: los orígenes externos se rechazan, los secretos jamás aparecen en el contrato, y una verificación rechazada devuelve un error tipado — no una alucinación.
MARS, HiveMind y Hyphae se construyen en abierto por Celiums Solutions — local-first, fail-closed y con recibos de punta a punta.