Wiki LLM de Karpathy
Patrón de base de conocimiento personal en el que un modelo escribe y mantiene un archivo markdown por concepto, con referencias cruzadas y trazabilidad de fuentes.
Patrón de gestión de conocimiento que Andrej Karpathy describió el 2 de abril de 2026, tras encontrarlo útil para construir bases de conocimiento personales sobre temas de investigación.
La idea central: en lugar de acumular documentos en bruto y consultarlos por recuperación, se mantiene una wiki de archivos markdown legibles por humanos pero escritos y editados por un modelo, con un archivo por concepto, referencias cruzadas, trazabilidad de la procedencia e historial de versiones en git.
Arquitectura
Tres componentes —raw, wiki, schema— y tres operaciones: ingest,
query, lint.
Los tres flujos de trabajo
Ingesta. Se dispara cuando llegan fuentes nuevas. El modelo lee cada documento, identifica las entidades y temas que cubre, comprueba si ya existen páginas para esas entidades y o bien crea páginas nuevas o bien actualiza las existentes. Cada actualización incluye una cita al documento de origen.
Consulta. Se navega y se pregunta sobre la wiki, no sobre el material en bruto.
Mantenimiento. Pasadas periódicas que detectan contradicciones, duplicados y páginas huérfanas.
Por qué compone
La diferencia frente a un sistema RAG convencional es dónde vive el trabajo de síntesis. En RAG, cada consulta reconstruye la respuesta desde fragmentos recuperados: el esfuerzo se repite y no deja residuo. Aquí la síntesis se escribe una vez en la página y las consultas siguientes parten de ella. El conocimiento se acumula en vez de recalcularse.
El coste es el inverso: hay que mantener las páginas, y una wiki mal cuidada degrada en contradicciones silenciosas.
Escala observada
La bóveda que Karpathy construyó con este método alcanzó alrededor de 100 artículos y unas 400.000 palabras —el tamaño de un libro de texto— generados de forma incidental mientras trabajaba en otras cosas.
Estandarización
Este patrón es el que el Open Knowledge Format de Google Cloud formalizó en junio de 2026 como especificación portable.
Por qué hace falta
La wiki existe porque el modelo no consolida: el olvido catastrófico obliga a que el conocimiento viva fuera de los pesos, y la saturación de contexto impide meterlo todo en el prompt —ambos límites en memoria y arquitecturas—. El índice resuelve las dos cosas con el mismo mecanismo de divulgación progresiva que usan los Agent Skills: saber qué existe antes de leerlo. Ver capacidades de los agentes.
Su efecto perseguido es que el conocimiento sobreviva a la sesión, la misma apuesta que la documentación viva hace dentro de un repositorio: conocimiento y documentación.
Cómo se aplica en este bundle
Los artículos del blog son la capa raw/; fuentes/ resume cada uno y declara
a qué alimenta; temas/ fusiona lo que varias fuentes dicen de un mismo
asunto, y la síntesis recorre el conjunto. Las tres operaciones
del patrón —ingesta, consulta y mantenimiento— quedan registradas en log.md.
Citations
Gist original de Andrej Karpathy describiendo el sistema (2 de abril de 2026). Análisis del patrón frente a RAG convencional en Level Up Coding.