Alfred procesa tus documentos personales con inteligencia artificial directamente en tu computadora. Sin enviar datos a la nube. Sin suscripciones. Sin comprometer tu privacidad.
v0.3.0 • Requiere Windows 10 o superior
Todo lo que necesitas en un asistente con IA, sin comprometer tu privacidad
Usa modelos GGUF directamente con llama.cpp. Sin Ollama, Python, MCP ni un servicio de IA externo. La inferencia corre en tu máquina.
Tus prompts, respuestas y archivos no se envían a una IA remota. El cifrado AES-256-GCM opcional protege determinados datos nuevos cuando el build incluye OpenSSL.
Extrae y consulta el contenido de tus archivos PDF con PDFium. Adjunta documentos directamente en la conversación.
Soporte nativo NVIDIA CUDA (Turing, Ampere, Ada) con llama.cpp. Inferencia rápida sin capas intermedias ni configuración adicional.
Chat con efectos visuales, renderizado Markdown completo, tablas profesionales y gestión de conversaciones.
Extrae texto de PDFs con PDFium y usa archivos de texto, Markdown, JSON, CSV y otros formatos basados en texto como contexto de una conversación.
A diferencia de otros asistentes con IA, Alfred no requiere conexión a internet para funcionar. La inferencia se procesa localmente; solo la búsqueda y descarga de modelos desde Hugging Face requiere red.
Nota: Alfred no requiere Ollama ni Python. Solo necesitas un modelo en formato
GGUF. Puedes buscarlo y descargarlo desde la pantalla Modelos o copiar un archivo local en
%APPDATA%\Alfred\models\; después, la inferencia funciona offline.
Instalación simple en minutos. Sin registro ni suscripciones.
Si tienes una GPU NVIDIA (RTX 20xx o superior), descarga la versión GPU para inferencia acelerada con CUDA. Si no tienes GPU NVIDIA o no estás seguro, descarga la versión CPU para Windows x64.
v0.3.0 • NVIDIA RTX 20xx+ • Windows 10+
v0.3.0 • Sin GPU requerida • Windows 10+
Ejecuta el instalador correspondiente a GPU o CPU, o extrae el ZIP portable
Busca un repositorio GGUF de Hugging Face o copia un GGUF en la carpeta de modelos
Elige una cuantización adecuada para tu RAM o VRAM y selecciona el modelo
El modelo se carga al primer mensaje y la inferencia se realiza localmente
Sí, Alfred es completamente gratis y de código abierto bajo Apache License 2.0. No hay costos ocultos, suscripciones ni límites de uso.
Solo para obtener Alfred y, si lo deseas, buscar o descargar un GGUF desde Hugging Face. Con un modelo local seleccionado, los chats funcionan sin internet.
No hay telemetría y los prompts no se envían a un proveedor de IA. La pantalla Modelos sí se conecta a Hugging Face cuando buscas o descargas; los logs de diagnóstico permanecen locales.
Sí, si tienes una GPU NVIDIA (Turing RTX 20xx o superior), descarga la versión GPU. Alfred usa CUDA nativo para acelerar la inferencia significativamente.
Alfred extrae texto de PDFs mediante PDFium y puede adjuntar formatos basados en texto como TXT, Markdown, JSON, XML, CSV, HTML, YAML y logs.
La aplicación de escritorio oficial se distribuye actualmente solo para Windows x64.