Lo que hace
Una pregunta. Una respuesta sacada de tus propias fuentes.
Mnemosyne vectoriza tu código, tus docs, tus notas, tus conversaciones — y más, y luego elige los vaults a consultar, dosifica el contexto, jerarquiza y descarta las fuentes que no aportan nada. Todo ello en tu procesador, sin que una sola línea salga de tu disco.
Y la dosificación importa más que la cantidad: con el mismo modelo, pregunta y recuperación idénticos, 91 fuentes inyectadas dan una respuesta hueca; 12 fuentes elegidas dan una síntesis estructurada.
La arquitectura
Todo cabe en tu máquina. Solo una línea sale de ella.
El núcleo consulta tu memoria, la ordena, y la consolida cuando la máquina está en reposo. Los cartuchos — el lector, el CRM, el traductor — se conectan a él sin tocarlo nunca: cada uno escribe en su vault, aislado de la búsqueda e invisible al resto.
Cortafuegos cognitivo
Entre tus datos y el modelo, un puesto de control.
El modelo nunca toca tu bóveda . Cada recuperación se ensambla en tu máquina, se filtra, y solo las fuentes elegidas se le tienden — la frontera es intencionada: es lo que impide que un prompt astuto exfiltre tu memoria.
Zero-Trust , incluso en local: cada petición del SDK o del MCP lleva un token firmado de alcance limitado (FGAC ). Y cuando nada relevante aparece, la memoria se abstiene — te lo dice, en vez de inventar.
Cómo funciona
Cuatro mecanismos, y por qué existen.
I
Los vaults
Tu memoria no es un montón. Está dividida en vaults estancos, uno por dominio de vida, cada uno con sus propios derechos: quién puede leerlo, con qué tiene permiso de mezclarse, si aparece en el mapa. Tu diario íntimo solo se mezcla con tu código si tú lo decides. Nunca por defecto, nunca por accidente.
II
Los temas
La memoria se ordena sola en temas, y esa estructura se almacena como un dato — no como un efecto secundario. Es ella la que hace posible el resto.
III
El estado de sueño
Con la máquina en reposo, Mnemosyne relee su propia memoria, tema por tema, y escribe su registro: cada ocurrencia, cada valor, cada fecha, el total actual. El registro se posa junto a lo bruto — nunca en su lugar. Es lo que vale +4,9 puntos en el verdadero camino de consulta y 1/8 → 5/8 en la categoría más difícil. No «te duplica la memoria». Esto.
IV
El pacto del sandbox
Cada aplicación recibe exactamente un vault, aislado de la búsqueda federada, invisible al mapa y al sueño. No puede ensanchar sus propios muros: abrir la permanencia es una operación que la red no puede alcanzar — solo tu mano sobre tu teclado puede. Un agente puede proponer. No puede grabar.
El motor
Cualquier modelo. Local o cloud. La misma memoria.
Elige el mejor modelo para cada tarea — el cloud para la potencia bruta, el local para una confidencialidad absoluta. Debajo, la memoria no cambia: cambias de proveedor sin perder nada.
Razonamiento y chat
Embeddings y resonancia
Hubs y proveedores
Bajo el capó
Los motores.
No una gran caja negra «IA» — varios motores independientes, cada uno con su tarea:
Motor de embedding
Una cadena de proveedores por prioridad — nube, ONNX local, Ollama. Falla ruidosamente antes que devolver un vector nulo: un embedding fallido nunca debe volverse en silencio una memoria invisible.
Motor de recuperación
Una caché vectorial descifrada en RAM (cuantizada int8 para escalar). Búsqueda ANN unida al matching exacto de términos, y re-ranking final.
Motor de spine
Clasifica cada recuerdo por naturaleza semántica — su «spine» + tags — desde una taxonomía que vive como datos, no como lógica codificada. Una categoría nueva no exige cambiar código.
Dream State
Consolidación a dos velocidades: un nivel rápido extrae hechos durante el uso, un nivel pesado corre en reposo/de noche para resolver contradicciones y enlazar sesiones. Se añade junto a la recuperación bruta, sin reemplazarla nunca en silencio.
RAG adaptativo — la caja de cambios
La selección de contexto (top-k / MMR / muestreo de baja discrepancia) se adapta al modelo que usas y al modo de razonamiento elegido — en vez de inyectar todos los candidatos.
Voz — STT & TTS
Motores independientes: modelos STT pequeños in-process, los grandes en un sidecar GPU/CPU aislado; TTS sistema, nube o local, sincronizado a la muestra para lectura sin cortes. ¿Sin GPU NVIDIA? → repliegue a CPU, nunca un bloqueo.
242 canales IPC
Canales validados con Zod conectan cada motor con la interfaz — autogenerados y verificados por un test de deriva en cada build.
Los módulos
Nueve módulos. Un solo núcleo.
No una gran caja «IA», sino módulos independientes, tallados cada uno para su tarea, todos conectados al mismo corazón de memoria. Esto es lo que ves y manipulas — los motores internos, ellos, permanecen sellados.
Neural Map
Tu memoria representada en topología matemática viva: los nodos son recuerdos, las aristas vínculos semánticos medidos, ajustados en directo.
Estado de sueño
Un motor de consolidación que relee y vincula tus recuerdos durante las fases de reposo.
Vaults
Una memoria compartimentada por dominio de vida, cada uno con su nivel de protección y su frontera de consentimiento.
RAG adaptativo
La profundidad de recuperación y el orden se adaptan al modelo que ejecutas — desde el LLM de portátil hasta el modelo cloud de vanguardia.
Asistente de voz
Voz local o cloud, STT/TTS en streaming, lectura local sin cortes.
Chat multimodal
Conversación de texto, voz y archivos, con recuperación en directo desde tus propios vaults.
MnemoHub
Un catálogo de cartuchos firmado por un wallet soberano y verificado del lado del cliente antes de todo renderizado.
Wallet soberano & Engramm
Un wallet Web3 local pilota la licencia (verificada en Base), el seudónimo y los créditos cloud — sin cuenta, sin contraseña, sin comisiones de gas.
Canvas espacial
Los widgets viven en un canvas 2D, no en pestañas apiladas: la posición aporta sentido.