Dos millones de años de conocimiento. Una caja. Sin internet.
El Arca del Conocimiento es una sola computadora autónoma que ejecuta una IA de código abierto junto a más de un terabyte y medio del conocimiento escrito de la humanidad — medicina, ingeniería, matemáticas, agricultura, derecho, literatura, los mapas del planeta entero — y sigue respondiendo preguntas cuando la red desaparece, cuando no hay electricidad y cuando nadie va a venir a ayudar.
Se paga el equipo una vez. Responde durante el resto de su vida.
Una mente que razona.
Una biblioteca que recuerda.
Toda IA que usted haya usado es una mente alquilada al final de un cable. Corte el cable y no queda nada. Además se inventa cosas — con fluidez, con seguridad y equivocándose — porque un modelo de lenguaje recuerda de forma poco fiable por construcción.
Toda enciclopedia sin conexión tiene el problema contrario. Es confiable y completamente inerte. No puede responder una pregunta. Solo puede consultarla quien ya sabe cómo se llama la respuesta.
El Arca lleva las dos cosas y las conecta entre sí. Cuando se le pregunta algo, responde como lo haría una persona que sabe del tema, de forma completa y en su idioma, y luego contrasta esa respuesta con los archivos: los pasajes que tratan su pregunta aparecen al lado, citados, para que usted abra la fuente y la lea, y todo lo que los archivos no respaldan queda marcado como aporte propio del modelo.
Ese es todo el diseño. El modelo aporta el conocimiento y el razonamiento. La biblioteca lo mantiene honesto.
Un sistema que solo sabe decirle cómo potabilizar agua y entablillar un hueso es una herramienta de supervivencia. Un sistema que además lleva la literatura es una copia de respaldo de la civilización.
Por qué importa el respaldo documental
La búsqueda semántica por sí sola falla justo en lo que hace daño cuando se equivoca — dosis, números de parte, voltajes, nombres de compuestos. El Arca usa recuperación híbrida: búsqueda por sentido para encontrar el pasaje correcto aunque no use ninguna de sus palabras, más coincidencia exacta de términos para que M8×1,25 siga siendo M8×1,25.
Una pregunta,
de principio a fin.
Una sesión real en el nodo, capturada de su propia pantalla. Nada de esto es una maqueta, y nada salió de la máquina para hacerla.
-
Captura de la superficie del Ark. Columna izquierda: pasajes de las fuentes, el primero de A Community Guide to Environmental Health, de Hesperian. Columna derecha: la respuesta, con gotas y cucharaditas de cloro por litro y por galón, cada cantidad seguida de números de cita entre corchetes, bajo un aviso ámbar de verificar antes de actuar.Pregunte como le preguntaría a una persona.
La superficie responde como alguien que conoce el tema: cuánto cloro, para cuánta agua, qué hacer si el agua está turbia. Cada cifra lleva su cita, y los pasajes de donde salió están en la columna de al lado. Como el tema es un químico, un aviso ámbar le pide leer la fuente antes de actuar.
-
Página 116 de Nuclear War Survival Skills, abierta desde Kiwix en el visor de PDF del navegador, bajo el título Disinfecting Water: una cucharadita escasa de cloro de uso doméstico por cada 10 galones de agua clara, o 2 gotas por cada cuarto de galón.Cada cita abre la página de donde salió.
La cita [4] abre Nuclear War Survival Skills en Kiwix, en la misma máquina, en el párrafo que usó la respuesta: una cucharadita escasa de cloro al 5,25% por cada diez galones de agua clara, dos gotas por cuarto de galón. La cifra se comprueba contra el original, no contra un resumen.
-
La misma página, desplazada. Izquierda: pasajes de un curso de LibreTexts para operadores de agua y de Nuclear War Survival Skills. Derecha: un bloque titulado respuesta de Qwen, no del archivo, donde el modelo añade su propia orientación sobre la concentración del cloro y una prueba de olor.Luego añade lo que sabe, y lo dice.
Después de la respuesta citada, el modelo ofrece lo que sabe más allá de los pasajes: la prueba del olor, el ajuste para un cloro más concentrado. El bloque va marcado como propio. Ningún pasaje lo respalda y nada en el nodo puede comprobarlo, así que nunca se confunde con el archivo.
-
Más abajo en la misma página: la respuesta de Gemma a partir de los mismos pasajes, con las mismas cantidades de gotas y sus números de cita, y una nota verde que dice que las dos familias de modelos coinciden.Una segunda familia de modelos lee los mismos pasajes.
Gemma, de un desarrollador distinto al de Qwen, responde por su cuenta desde las mismas fuentes, y el nodo compara las dos respuestas citadas. Aquí coinciden. Cuando no, la tarjeta lo dice y lo envía a los pasajes: una señal, no un veredicto.
-
La página de la biblioteca de Kiwix, 58 libros en su vista en inglés: ArchWiki, Wikipedia, True Prepper, WikiVet, Libre Pathology, Wiktionary, Appropedia, MDWiki y más, cada uno una tarjeta con su logotipo.Detrás de las respuestas, la biblioteca entera.
Kiwix sirve todos los libros del nodo, 67, desde Wikipedia hasta WikEM. Cuarenta y cuatro alimentan las respuestas; los otros veintitrés se consultan aquí, con el buscador propio de Kiwix. Todos se abren y se leen página por página. Esta vista está filtrada al inglés.
-
El mapa sin conexión sobre Pereira, Colombia: vías sobre cerros sombreados, y un panel con el sombreado y el relieve 3D activados y una coordenada señalada.El planeta, sin conexión.
Un mapa base de 137,5 GB del mundo entero y 706 GB de relieve, dibujados por el nodo con sombreado y relieve en 3D. Haga clic en un punto y le entrega el comando que consulta su zona climática. Sin servidor de teselas, sin internet.
-
La página de chat de llama.cpp con la pregunta sobre cómo desinfectar agua potable con cloro de uso doméstico, y la respuesta numerada de Qwen, sin citas.O pregúntele directamente al modelo.
El modelo también tiene su propia página de chat, la de llama.cpp, a la que se llega desde el nodo. Es más rápida, y está marcada por lo que es: sin archivo y sin citas. La misma pregunta sobre el cloro, respondida solo desde su entrenamiento.
-
La superficie del Ark en el ancho de un teléfono: la caja de búsqueda y, debajo, la respuesta citada con sus números de cita.Desde cualquier teléfono de la sala.
Todo lo anterior se abre en el navegador de un teléfono, por la propia red WiFi del nodo. Sin aplicación que instalar, sin cuenta, sin nada que actualizar.
Capturado en el nodo el 28 de septiembre de 2026 y sin retocar: donde un modelo se equivocó, el error sigue en la imagen.
Pasajes citados del archivo: © Hesperian Health Guides; LibreTexts; Nuclear War Survival Skills, dominio público; Chemistry Stack Exchange, CC BY-SA 4.0. Datos del mapa © colaboradores de OpenStreetMap, ODbL, vía Protomaps; relieve de Mapterhorn. Página de chat: llama.cpp, MIT.
No es un kit de supervivencia.
Es la herencia completa.
Casi todos los dispositivos de conocimiento sin conexión se detienen en agua, heridas, fuego y navegación. El Arca lleva todo eso — y sigue, hacia el material que le permite a una comunidad no solo sobrevivir, sino enseñar, comerciar, construir, discutir y leer.
Wikipedia completa
Las ediciones completas en inglés y en español, con imágenes y diagramas — no las versiones reducidas de solo texto. Además Wikcionario en ambos idiomas y diccionarios bilingües.
Referencia médica de campo
El subconjunto médico de Wikipedia junto a manuales de campo de libre distribución — Donde no hay doctor, Donde no hay dentista — en inglés y español, más referencias de enfermedades regionales tomadas de material de los CDC y la OMS.
iFixit, Restarters y Appropedia
Manuales de reparación paso a paso, con fotografías, para electrónica, electrodomésticos, vehículos y herramientas, en inglés y español, junto a un archivo comunitario de reparación con diagnósticos y las fallas más frecuentes, y guías de tecnología apropiada para energía solar, agua y saneamiento.
Archivos de Stack Exchange
Electrónica, química, física, biología, programación. El formato de pregunta y respuesta se parece mucho más a la forma de un problema real que la prosa enciclopédica.
OpenStax y LibreTexts
Libros de texto de verdad — de prealgebra a cálculo, estadística y física — con ejemplos resueltos, ejercicios graduados y respuestas. Se toman los catálogos en español junto con los de inglés. Wikipedia es una mala maestra de matemáticas; estos no lo son.
Proyecto Gutenberg
Unos 75 GB, y el tesoro discreto está en lo publicado antes de 1928: ingeniería, agricultura, química y metalurgia escritas en una época en que esas materias se enseñaban como procedimiento, para gente que trabajaba sin cadena de suministro.
Contabilidad, contratos, comercio
Contabilidad por partida doble — quinientos años de antigüedad, no requiere tecnología alguna, y cualquier grupo mayor que un hogar la necesita. Fundamentos de contratos, historia monetaria, formación de precios, pesos y medidas, estructuras cooperativas y de cajas de crédito.
Agricultura, indexada por clima
Publicaciones de la FAO organizadas por zona climática, material de extensión agrícola de EE. UU. de muchas zonas distintas, guías de agricultura sostenible, conservación de semillas, preservación de alimentos, referencia veterinaria — más mapas de Köppen y de rusticidad para que el operador identifique su zona y navegue el resto.
El planeta entero, cartografiado
Los mapas vectoriales globales de OpenStreetMap en un único archivo autónomo, servible a cualquier teléfono de la red local. Sin servidor de mapas en internet, sin tener que elegir una región de antemano, sin que una mudanza lo rompa.
Literatura y cultura
Project Gutenberg en inglés y en español — poesía, teatro, filosofía y las novelas. Standard Ebooks y la Biblioteca Cervantes están programados y aún no están en el disco, lo que hoy hace de la literatura en español el estante más delgado del Arca. Decirlo es más útil que insinuar lo contrario.
Manuales y compendios
Compendios de química y materiales, ingeniería de tratamiento de agua y saneamiento, manuales de operación y equipos de radioafición, hidrología, datos sísmicos y de amenazas, normas de construcción según el clima.
Aprendizaje en ambas direcciones
Gramáticas y material de aprendizaje para hispanohablantes que aprenden inglés y para anglohablantes que aprenden español — dos corpus distintos, y se llevan los dos.
Simplemente se le puede hablar.
El Arca escucha y habla, en inglés y en español. Esto no es una comodidad añadida al final. Es la interfaz que funciona cuando uno tiene las manos llenas de grasa, cuando quien pregunta no escribe bien o no sabe leer, y cuando la pantalla está apagada para ahorrar batería.
- 01Pulsar para hablar. Un botón físico, un pedal o una tecla — no una palabra de activación. Escuchar de forma permanente consume energía constante, y una activación falsa despierta un modelo de 27 mil millones de parámetros. Un botón no cuesta nada en reposo y funciona en un taller ruidoso, donde la detección por palabra clave falla.
- 02La escucha. Reconocimiento de voz de código abierto que corre por completo en el dispositivo, preciso en ambos idiomas, con un modelo pequeño y rápido en el nodo de respaldo para cuando el principal está apagado.
- 03Le muestra lo que entendió. La transcripción aparece para confirmación antes de que la pregunta se ejecute. Una pregunta mal entendida se ve exactamente igual que una correcta.
- 04Responde en voz alta. Voz neuronal natural, 54 voces en ocho grupos de idioma y acento, más rápido que en tiempo real — con un modelo de síntesis de voz de menos de 400 MB y licencia Apache.
- 05Salvo cuando no debe. Toda respuesta que contenga una dosis, un voltaje, una tolerancia, una presión, una temperatura o un número de parte se escribe en pantalla o en papel, nunca se entrega solo por audio. El reconocimiento de voz falla justamente en esas cosas, y una respuesta hablada no se puede releer. La voz es una capa de entrada y de comodidad, no un canal de salida para nada que pueda hacerle daño a alguien.
Lo que esto habilita
Un niño que todavía no sabe leer puede preguntar por qué cambia de forma la luna y recibir respuesta. Un adulto mayor que nunca aprendió a escribir en teclado puede preguntar por un medicamento. Un mecánico con las dos manos dentro de un motor puede pedir un dato de torque. Una familia sin ninguna pantalla encendida puede escuchar una novela leída en voz alta.
Redundancia por diseño
Dos motores de síntesis de voz independientes que fallan de maneras distintas en vez de compartir una debilidad, dos tamaños de modelo de reconocimiento, y una tercera vía de reconocimiento integrada en el propio modelo de lenguaje del nodo de respaldo. La voz sobrevive a la pérdida de cualquier componente.
Expectativa honesta
Una respuesta hablada de fondo toma del orden de diez a veinte segundos de principio a fin. Eso es una herramienta de consulta a la que uno le habla. No es un compañero de conversación, y fingir lo contrario es la forma en que se abandonan las interfaces de voz.
También puede mantener
las máquinas andando.
El Arca lleva un modelo de programación dedicado, y la razón no es el desarrollo de software. Es que un sitio fuera de la red está lleno de computadoras pequeñas de las que nadie tiene documentación — y el nodo que sabe hablarles vale más que el nodo que apenas sabe sobre ellas.
Un controlador de carga, un temporizador de bomba, un inversor, un radio de dos vías, una válvula de riego. Cada uno de ellos es una computadora, cada uno habla algún protocolo — registros Modbus, comandos AT, un menú serial enterrado en la página cuarenta de un manual — y ninguno vino con el único programa que uno de verdad necesita.
Ese programa siempre es específico de su sitio. Que la bomba funcione cuando la batería esté por encima del 60 % y los paneles estén produciendo. Nadie lo vende. Hay que escribirlo donde va a correr, contra el equipo que de verdad está ahí.
Así que el Arca no es solo algo a lo que uno le pregunta. Es algo que se puede conectar a la misma cosa sobre la que le está aconsejando — leyendo una hoja de datos por un extremo y produciendo código de control funcional por el otro.
Lee el equipo
Entréguele el manual y le dirá cuál registro reporta el estado de carga, cuál reporta la corriente fotovoltaica y qué significa en realidad ese byte de estado sin documentar que viene en la respuesta. Este es el trabajo que de otro modo exige un ingeniero que ya haya visto ese equipo exacto.
Escribe el pegamento
Programas de microcontrolador, scripts de shell, lógica de cron, archivos de configuración, el analizador de un registro que nadie documentó. Cuarenta líneas que hacen que una máquina le responda a otra — esa clase de código que es trivial para un especialista e imposible para todos los demás.
Otro oficio distinto
Los modelos generales son peores en esto de forma medible que un modelo entrenado para hacerlo, y por eso el nivel de programación se lleva aparte en vez de darse por supuesto. Cuesta unos 20 GB — nada frente a un disco de 8 TB — y es la diferencia entre una biblioteca de consulta y un nodo capaz de mantener un sitio.
Y la regla que aplica
El código generado que vaya a mover una bomba, un relé o un controlador de carga se lee y se prueba en seco antes de energizar nada. La misma doctrina que con una dosis: el modelo propone, el operador verifica, y donde hay consecuencia la respuesta pasa primero por el papel.
Un solo costo. Después, gratis para siempre.
Todo producto de IA sin conexión que hay hoy en el mercado es una suscripción, y una suscripción es un servidor de licencias con otro nombre. El Arca no tiene cuenta, ni clave, ni telemetría, ni cobro por consulta, ni nada que una empresa que ya no exista pueda apagar a distancia. Y tampoco tiene un solo precio — viene en cuatro tamaños, y la biblioteca es idéntica en todos ellos.
| Configuración | Con red eléctrica | Fuera de la red | Qué ejecuta |
|---|---|---|---|
| Lector — Raspberry Pi 5 | $580 | $1.080 | Archivo y mapas completos para cada teléfono a su alcance. Un modelo pequeño, despacio. |
| Aula — Mac Mini 32 GB | $1.740 | $2.840 | El escalón más barato que ejecuta el modelo completo de 27B a velocidad de conversación. |
| Comunidad — Mac Mini Pro 64 GB | $3.800 | $5.600 | La especificación lo nombra plenamente adecuado. Incluye nodo secundario. |
| Centro — Mac Studio 128 GB | $5.800 | $8.500 | Dos familias de modelos residentes a la vez. El único escalón que construye índices. |
| Todo el software y todo el conocimiento | $0 | $0 | Apache 2.0 y MIT en su totalidad; cada corpus de licencia abierta. |
| Cada pregunta, para siempre | $0 | $0 | Sin red, sin medición de consumo, sin nada que renovar. |
Tres de los cuatro cuestan menos que diez años de conectividad satelital — antes de comprar una sola suscripción de IA. El desarrollo completo está en la página Cuánto cuesta.
La regla que gobierna cada decisión
Sin interfaces propietarias. Sin servidores de licencias. Sin ningún componente que no pueda sustituirse por una pieza genérica. Si algo de esto no se puede comprar en cualquier parte ni reconstruir a partir de instrucciones impresas, no entra.
Por qué no sirven los aparatos sellados
Ya existen varios aparatos de conocimiento sin conexión, y son buenos. Todos fallan la misma prueba: cuando el aparato muere, la capacidad de reconstruir la capa de búsqueda muere con él, aunque los archivos sobrevivan. El Arca guarda el modelo de embeddings, el índice, los pesos en precisión completa y las herramientas de conversión en almacenamiento frío — de modo que el sistema entero se puede reconstruir en hardware nuevo, años después, sin conexión y por otra persona.
Costo repartido
Una sola Arca atiende a la vez un salón de clase, un puesto de salud, una caseta comunal o una casa por la red local, y el lector número doscientos no cuesta nada. Repartido entre una comunidad y una década eso son entre $1,93 y $28 por persona — y como los discos llevan el corpus, un Lector comprado este año se convierte el año entrante en el archivo de un nodo más grande sin descargar nada de nuevo.
Donde no llega el cable.
Un tutor paciente para todos los estudiantes a la vez, en dos idiomas y con los libros de texto detrás — en edificios que nunca han tenido ancho de banda confiable.
Referencia médica de campo e información de medicamentos en el punto de atención, donde el especialista más cercano está a un día de viaje y el buscador más cercano, más lejos todavía.
Un nodo sobre un panel solar, sirviendo teléfonos y tabletas por WiFi local en toda una caseta comunal. Mapas, enciclopedia, guías de reparación, agricultura y alguien a quien preguntarle.
Ayuda con las tareas que no puede irse a vagar por internet, el manual de reparación de la lavadora y una novela leída en voz alta por la noche.
Semanas o meses fuera de cobertura, con la carga de consulta de una biblioteca técnica entera y nada de su peso.
Cuando la infraestructura se cae y las respuestas hacen más falta que nunca, al Arca no le pasa nada — porque nunca estuvo conectada a nada de eso.
No hay nada que bloquear, limitar, filtrar ni revocar. No existe un proveedor aguas arriba que cortar.
Y si llega la peor versión del futuro: el conocimiento para reconstruir, en una caja que funciona con luz solar y con instrucciones impresas para restaurarla desde almacenamiento frío.
Lo que no es.
Un proyecto como este invita a prometer de más. Estos límites están diseñados a propósito, documentados y enseñados al operador — porque una herramienta en la que uno confía mal es más peligrosa que una en la que no confía nada.
- →Es un generalista competente, no un experto en un dominio. Va a afirmar datos incorrectos con total seguridad. Por eso toda respuesta muestra lo que dicen los archivos junto a lo que dice el modelo, con el pasaje a un clic, y por eso la doctrina de operación exige verificar cualquier cosa con consecuencia de seguridad contra los archivos o las referencias impresas antes de actuar.
- →No ve lo suficientemente bien como para diagnosticar. La comprensión de imágenes es útil y superficial. No va a identificar de forma confiable una planta, una herida o un componente con la precisión que exige una decisión con consecuencias.
- →No aprende. Su conocimiento queda congelado en la última actualización de los archivos. Eso es una ventaja — nada se desvía, nada se actualiza en silencio, nada se retracta a sus espaldas — pero es un límite real.
- →No puede comprobar lo que no está en los archivos. Donde la biblioteca calla, el modelo responde igual con lo que aprendió, y la pantalla dice claramente que nada en los archivos respalda esa parte. La calidad de la recuperación acota lo que se puede comprobar, por fluida que suene la respuesta.
- →La versión uno atiende dos idiomas. Quien no lea ni inglés ni español queda servido únicamente por la memoria propia del modelo, sin ningún archivo detrás. La capa de búsqueda se eligió precisamente para que añadir siete idiomas más sea una suma y no una reconstrucción.
- →No puede pedir ayuda. El satélite es de doble vía; ningún escalón de este nodo lo es. No va a llamar a un helicóptero, ni comunicarse con un familiar, ni reportar un derrumbe. En las primeras setenta y dos horas después de un desastre una conexión es el objeto más valioso, y por mucho. Esto va debajo de la conectividad, no en lugar de ella.
- →El reconocimiento de voz se degrada con ruido. Lo cual describe un taller, un cultivo y una emergencia. Una diadema de micrófono cercano es equipo obligatorio, no un accesorio.