Mnemosyne OS

Lo que hace

Una pregunta. Una respuesta sacada de tus propias fuentes.

Mnemosyne vectoriza tu código, tus docs, tus notas, tus conversaciones — y más, y luego elige los vaults a consultar, dosifica el contexto, jerarquiza y descarta las fuentes que no aportan nada. Todo ello en tu procesador, sin que una sola línea salga de tu disco.

Y la dosificación importa más que la cantidad: con el mismo modelo, pregunta y recuperación idénticos, 91 fuentes inyectadas dan una respuesta hueca; 12 fuentes elegidas dan una síntesis estructurada.

La arquitectura

Todo cabe en tu máquina. Solo una línea sale de ella.

El núcleo consulta tu memoria, la ordena, y la consolida cuando la máquina está en reposo. Los cartuchos — el lector, el CRM, el traductor — se conectan a él sin tocarlo nunca: cada uno escribe en su vault, aislado de la búsqueda e invisible al resto.

TU MÁQUINA CARTUCHOS MnemoReader Archipel CRM Translator Un vault por app. Aislado de la búsqueda federada, invisible al mapa y al sueño. No sale de ahí. TU APP @mnemosyne_os/sdk @mnemosyne_os/mcp pnpm add · la app debe estar en marcha NÚCLEO INFINITY búsqueda · orden · consolidación TU MEMORIA Diario Notas Investigación Desarrollo Biblioteca Crece con cada documento. relee escribe ESTADO DE SUEÑO el registro se posa junto a lo bruto MODELO local, o el tuyo opcional — solo si conectas el cloud TU CLAVE API CRÉDITOS MEDIDOS
La línea continua se queda en la máquina. La línea de puntos es la única que sale de ella — y solo si eliges un modelo cloud. El modelo local, en cambio, nunca sale.

La línea continua se queda en la máquina. La línea de puntos es la única que sale de ella — y solo si eliges un modelo cloud. El modelo local, en cambio, nunca sale.

Cortafuegos cognitivo

Entre tus datos y el modelo, un puesto de control.

El modelo nunca toca tu bóveda . Cada recuperación se ensambla en tu máquina, se filtra, y solo las fuentes elegidas se le tienden — la frontera es intencionada: es lo que impide que un prompt astuto exfiltre tu memoria.

Zero-Trust , incluso en local: cada petición del SDK o del MCP lleva un token firmado de alcance limitado (FGAC ). Y cuando nada relevante aparece, la memoria se abstiene — te lo dice, en vez de inventar.

Cómo funciona

Cuatro mecanismos, y por qué existen.

I

Los vaults

Tu memoria no es un montón. Está dividida en vaults estancos, uno por dominio de vida, cada uno con sus propios derechos: quién puede leerlo, con qué tiene permiso de mezclarse, si aparece en el mapa. Tu diario íntimo solo se mezcla con tu código si tú lo decides. Nunca por defecto, nunca por accidente.

II

Los temas

La memoria se ordena sola en temas, y esa estructura se almacena como un dato — no como un efecto secundario. Es ella la que hace posible el resto.

III

El estado de sueño

Con la máquina en reposo, Mnemosyne relee su propia memoria, tema por tema, y escribe su registro: cada ocurrencia, cada valor, cada fecha, el total actual. El registro se posa junto a lo bruto — nunca en su lugar. Es lo que vale +4,9 puntos en el verdadero camino de consulta y 1/8 → 5/8 en la categoría más difícil. No «te duplica la memoria». Esto.

IV

El pacto del sandbox

Cada aplicación recibe exactamente un vault, aislado de la búsqueda federada, invisible al mapa y al sueño. No puede ensanchar sus propios muros: abrir la permanencia es una operación que la red no puede alcanzar — solo tu mano sobre tu teclado puede. Un agente puede proponer. No puede grabar.

El motor

Cualquier modelo. Local o cloud. La misma memoria.

Elige el mejor modelo para cada tarea — el cloud para la potencia bruta, el local para una confidencialidad absoluta. Debajo, la memoria no cambia: cambias de proveedor sin perder nada.

Razonamiento y chat

GeminiClaudeGPTDeepSeekMistralLlamaQwen

Embeddings y resonancia

JinaNomicBGE-M3OpenAI

Hubs y proveedores

OpenRouterGroqOllama

Bajo el capó

Los motores.

No una gran caja negra «IA» — varios motores independientes, cada uno con su tarea:

Motor de embedding

Una cadena de proveedores por prioridad — nube, ONNX local, Ollama. Falla ruidosamente antes que devolver un vector nulo: un embedding fallido nunca debe volverse en silencio una memoria invisible.

Motor de recuperación

Una caché vectorial descifrada en RAM (cuantizada int8 para escalar). Búsqueda ANN unida al matching exacto de términos, y re-ranking final.

Motor de spine

Clasifica cada recuerdo por naturaleza semántica — su «spine» + tags — desde una taxonomía que vive como datos, no como lógica codificada. Una categoría nueva no exige cambiar código.

Dream State

Consolidación a dos velocidades: un nivel rápido extrae hechos durante el uso, un nivel pesado corre en reposo/de noche para resolver contradicciones y enlazar sesiones. Se añade junto a la recuperación bruta, sin reemplazarla nunca en silencio.

RAG adaptativo — la caja de cambios

La selección de contexto (top-k / MMR / muestreo de baja discrepancia) se adapta al modelo que usas y al modo de razonamiento elegido — en vez de inyectar todos los candidatos.

Voz — STT & TTS

Motores independientes: modelos STT pequeños in-process, los grandes en un sidecar GPU/CPU aislado; TTS sistema, nube o local, sincronizado a la muestra para lectura sin cortes. ¿Sin GPU NVIDIA? → repliegue a CPU, nunca un bloqueo.

242 canales IPC

Canales validados con Zod conectan cada motor con la interfaz — autogenerados y verificados por un test de deriva en cada build.

Los módulos

Nueve módulos. Un solo núcleo.

No una gran caja «IA», sino módulos independientes, tallados cada uno para su tarea, todos conectados al mismo corazón de memoria. Esto es lo que ves y manipulas — los motores internos, ellos, permanecen sellados.

Neural Map

Tu memoria representada en topología matemática viva: los nodos son recuerdos, las aristas vínculos semánticos medidos, ajustados en directo.

Estado de sueño

Un motor de consolidación que relee y vincula tus recuerdos durante las fases de reposo.

Vaults

Una memoria compartimentada por dominio de vida, cada uno con su nivel de protección y su frontera de consentimiento.

RAG adaptativo

La profundidad de recuperación y el orden se adaptan al modelo que ejecutas — desde el LLM de portátil hasta el modelo cloud de vanguardia.

Asistente de voz

Voz local o cloud, STT/TTS en streaming, lectura local sin cortes.

Chat multimodal

Conversación de texto, voz y archivos, con recuperación en directo desde tus propios vaults.

MnemoHub

Un catálogo de cartuchos firmado por un wallet soberano y verificado del lado del cliente antes de todo renderizado.

Wallet soberano & Engramm

Un wallet Web3 local pilota la licencia (verificada en Base), el seudónimo y los créditos cloud — sin cuenta, sin contraseña, sin comisiones de gas.

Canvas espacial

Los widgets viven en un canvas 2D, no en pestañas apiladas: la posición aporta sentido.