Mnemosyne OS
Nuevo La documentación está en línea: cada motor, paso a paso. docs.mnemosyne-os.io →

Lo que hace

Una pregunta. Una respuesta sacada de tus propias fuentes.

Mnemosyne vectoriza tu código fuente, tus imágenes, tus PDF, tus docs, tus notas, tus conversaciones, y más, y luego elige los vaults a consultar, dosifica el contexto, jerarquiza y descarta las fuentes que no aportan nada. Todo ello en tu procesador, sin que una sola línea salga de tu disco.

Y la dosificación importa más que la cantidad: con el mismo modelo, pregunta y recuperación idénticos, 91 fuentes inyectadas dan una respuesta hueca; 12 fuentes elegidas dan una síntesis estructurada.

La arquitectura

Todo cabe en tu máquina. Solo una línea sale de ella.

El núcleo consulta tu memoria, la ordena, y la consolida cuando la máquina está en reposo. Los cartuchos, el lector, el CRM, el traductor, se conectan a él sin tocarlo nunca: cada uno escribe en su vault, aislado de la búsqueda e invisible al resto.

MNEMOHUB instalar un cartucho, o publicar uno — nunca tu memoria TU MÁQUINA CARTUCHOS MnemoReader Archipel CRM Translator Un vault por app. Aislado de la búsqueda federada, invisible al mapa y al sueño. No sale de ahí. APP Y AGENTES @mnemosyne_os/sdk @mnemosyne_os/mcp Claude Code · Cursor · Antigravity Hermes Agent — la app debe estar activa NÚCLEO INFINITY búsqueda · orden · consolidación TU MEMORIA Diario Notas Investigación Desarrollo Biblioteca Crece con cada documento. relee escribe ESTADO DE SUEÑO el registro se posa junto a lo bruto MODELO local, o el tuyo opcional, solo si conectas el cloud TU CLAVE API CRÉDITOS MEDIDOS
Dos líneas de puntos pueden salir de la máquina: una llamada opcional a un modelo cloud, e instalar o publicar un cartucho en MnemoHub. Ninguna transporta jamás tu memoria — una mueve un prompt, la otra un paquete de app.

Dos líneas de puntos pueden salir de la máquina: una llamada opcional a un modelo cloud, e instalar o publicar un cartucho en MnemoHub. Ninguna transporta jamás tu memoria — una mueve un prompt, la otra un paquete de app.

Cortafuegos cognitivo

Entre tus datos y el modelo, un puesto de control.

El modelo nunca toca tu bóveda . Cada recuperación se ensambla en tu máquina, se filtra, y solo las fuentes elegidas se le tienden, la frontera es intencionada: es lo que impide que un prompt astuto exfiltre tu memoria.

Zero-Trust , incluso en local: cada petición del SDK o del MCP lleva un token firmado de alcance limitado (FGAC ). Y cuando nada relevante aparece, la memoria se abstiene, te lo dice, en vez de inventar.

Cómo funciona

Cuatro mecanismos, y por qué existen.

I

Los vaults

Tu memoria no es un montón. Está dividida en vaults estancos, uno por dominio de vida, cada uno con sus propios derechos: quién puede leerlo, con qué tiene permiso de mezclarse, si aparece en el mapa. Tu diario íntimo solo se mezcla con tu código si tú lo decides. Nunca por defecto, nunca por accidente.

II

Los temas

La memoria se ordena sola en temas, y esa estructura se almacena como un dato, no como un efecto secundario. Es ella la que hace posible el resto.

III

El estado de sueño

Con la máquina en reposo, Mnemosyne relee su propia memoria, tema por tema, y escribe su registro: cada ocurrencia, cada valor, cada fecha, el total actual. El registro se posa junto a lo bruto, nunca en su lugar. Es lo que vale +4,9 puntos en el verdadero camino de consulta y 1/8 → 5/8 en la categoría más difícil. No «te duplica la memoria». Esto.

IV

El pacto del sandbox

Cada aplicación recibe exactamente un vault, aislado de la búsqueda federada, invisible al mapa y al sueño. No puede ensanchar sus propios muros: abrir la permanencia es una operación que la red no puede alcanzar, solo tu mano sobre tu teclado puede. Un agente puede proponer. No puede grabar.

El motor

Cualquier modelo. Local o cloud. La misma memoria.

Elige el mejor modelo para cada tarea, el cloud para la potencia bruta, el local para una confidencialidad absoluta. Debajo, la memoria no cambia: cambias de proveedor sin perder nada.

Razonamiento y chat

GeminiClaudeGPTDeepSeekMistralLlamaQwen

Embeddings y resonancia

NomicE5BGEJinaOpenAI

Hubs y proveedores

GroqVertex AIMiniMax

Bajo el capó

Los motores.

No una gran caja negra «IA». Varios motores independientes, cada uno con su tarea:

Motor de embedding

Una cadena de proveedores por prioridad: nube, ONNX local, Ollama. Falla ruidosamente antes que devolver un vector nulo: un embedding fallido nunca debe volverse en silencio una memoria invisible.

Motor de recuperación

Una caché vectorial descifrada en RAM (cuantizada int8 para escalar). Búsqueda ANN unida al matching exacto de términos, y re-ranking final.

Motor de spine

Clasifica cada recuerdo por naturaleza semántica, su «spine» y sus tags, desde una taxonomía que vive como datos, no como lógica codificada. Una categoría nueva no exige cambiar código.

Dream State

Consolidación a dos velocidades: un nivel rápido extrae hechos durante el uso, un nivel pesado corre en reposo/de noche para resolver contradicciones y enlazar sesiones. Se añade junto a la recuperación bruta, sin reemplazarla nunca en silencio.

RAG adaptativo, la caja de cambios

La selección de contexto (top-k / MMR / muestreo de baja discrepancia) se adapta al modelo que usas y al modo de razonamiento elegido, en vez de inyectar todos los candidatos.

Voz: STT y TTS

Motores independientes: modelos STT pequeños in-process, los grandes en un sidecar GPU/CPU aislado; TTS sistema, nube o local, sincronizado a la muestra para lectura sin cortes. ¿Sin GPU NVIDIA? → repliegue a CPU, nunca un bloqueo.

Theia, memoria de imágenes

Por la Titánide de la vista, hermana de Mnemosyne: el OS de memoria gana un ojo. Vectoriza localmente las imágenes de tus vaults (SigLIP 2, en tu máquina) y las recuerda en el chat: pide «las piezas que se parecen a una taza azul» y las coincidencias aparecen como miniaturas, halladas por tres canales fusionados por rango: semántica, paleta de píxeles, categorías emergentes. Desactivado por defecto; un motor frío o aún indexando lo dice, en vez de fingir «sin resultados».

437 canales IPC

Canales validados con Zod conectan cada motor con la interfaz, autogenerados y verificados por un test de deriva en cada build.

Los módulos

Nueve módulos. Un solo núcleo.

No una gran caja «IA», sino módulos independientes, tallados cada uno para su tarea, todos conectados al mismo corazón de memoria. Esto es lo que ves y manipulas, los motores internos, ellos, permanecen sellados.

Neural Map

Tu memoria dibujada como un grafo que recorres: los nodos son recuerdos, las aristas vínculos semánticos medidos, ajustados en directo.

Estado de sueño

Un motor de consolidación que relee y vincula tus recuerdos durante las fases de reposo.

Vaults

Una memoria compartimentada por dominio de vida, cada uno con su nivel de protección y su frontera de consentimiento.

RAG adaptativo

La profundidad de recuperación y el orden se adaptan al modelo que ejecutas, desde el LLM de portátil hasta el modelo cloud de vanguardia.

Asistente de voz

Voz local o cloud, STT/TTS en streaming, lectura local sin cortes.

Chat multimodal

Conversación de texto, voz y archivos, con recuperación en directo desde tus propios vaults.

MnemoHub

Un catálogo de cartuchos firmado por un wallet soberano y verificado del lado del cliente antes de todo renderizado.

Wallet soberano & Engramm

Un wallet soberano local pilota la licencia (verificada en Base), el seudónimo y los créditos cloud, sin cuenta, sin contraseña, sin comisiones de gas.

Canvas espacial

Los widgets viven en un canvas 2D, no en pestañas apiladas: la posición aporta sentido.

Ir más lejos

La arquitectura, en un artículo citable.

El Resonance Engine, los motores anteriores y la capa de gobernanza que los rige, se describe en un whitepaper técnico, depositado bajo un identificador permanente y publicado con licencia CC BY 4.0.