BETA Versión en desarrollo: Alfred está en fase BETA. Algunas funciones pueden cambiar.
IA local • Sin telemetría

Tu Asistente Personal con IA Local

Alfred procesa tus documentos personales con inteligencia artificial directamente en tu computadora. Sin enviar datos a la nube. Sin suscripciones. Sin comprometer tu privacidad.

v0.3.0 • Requiere Windows 10 o superior

Buenas noches, Juan Manuel García. Es un placer saludarte. ¿En qué puedo ayudarte esta noche?

Características

Potencia e Inteligencia en tu Escritorio

Todo lo que necesitas en un asistente con IA, sin comprometer tu privacidad

IA 100% Local

Usa modelos GGUF directamente con llama.cpp. Sin Ollama, Python, MCP ni un servicio de IA externo. La inferencia corre en tu máquina.

Privacidad Total

Tus prompts, respuestas y archivos no se envían a una IA remota. El cifrado AES-256-GCM opcional protege determinados datos nuevos cuando el build incluye OpenSSL.

Soporte de PDFs

Extrae y consulta el contenido de tus archivos PDF con PDFium. Adjunta documentos directamente en la conversación.

Aceleración GPU

Soporte nativo NVIDIA CUDA (Turing, Ampere, Ada) con llama.cpp. Inferencia rápida sin capas intermedias ni configuración adicional.

Interfaz Moderna

Chat con efectos visuales, renderizado Markdown completo, tablas profesionales y gestión de conversaciones.

Archivos Adjuntos

Extrae texto de PDFs con PDFium y usa archivos de texto, Markdown, JSON, CSV y otros formatos basados en texto como contexto de una conversación.

Privacidad

Tus Datos, Solo Tuyos

A diferencia de otros asistentes con IA, Alfred no requiere conexión a internet para funcionar. La inferencia se procesa localmente; solo la búsqueda y descarga de modelos desde Hugging Face requiere red.

  • Sin APIs externas ni servicios en la nube durante la inferencia
  • Cifrado AES-256-GCM opcional cuando OpenSSL está disponible
  • Conversaciones, configuración y modelos almacenados localmente
  • Código abierto y auditable bajo Apache License 2.0
Requisitos

Lo Que Necesitas para Empezar

Sistema Operativo

  • Windows 10 build 19041 o superior
  • 64-bit requerido

Hardware

  • RAM suficiente para el modelo GGUF seleccionado
  • Almacenamiento según el tamaño del modelo y su cuantización
  • GPU: NVIDIA RTX 20xx+ para la versión CUDA (opcional)

Modelo de IA

  • Modelo GGUF compatible (formato llama.cpp)
  • Descarga directa o copia manual en AppData\Roaming\Alfred\models
  • No se incluye en el instalador

Nota: Alfred no requiere Ollama ni Python. Solo necesitas un modelo en formato GGUF. Puedes buscarlo y descargarlo desde la pantalla Modelos o copiar un archivo local en %APPDATA%\Alfred\models\; después, la inferencia funciona offline.

Descarga

Comienza a Usar Alfred Ahora

Instalación simple en minutos. Sin registro ni suscripciones.

¿Qué versión elegir?

Si tienes una GPU NVIDIA (RTX 20xx o superior), descarga la versión GPU para inferencia acelerada con CUDA. Si no tienes GPU NVIDIA o no estás seguro, descarga la versión CPU para Windows x64.

Alfred — GPU (CUDA)

v0.3.0 • NVIDIA RTX 20xx+ • Windows 10+

Aceleración NVIDIA CUDA
Recomendado para RTX 20xx / 30xx / 40xx
Descargar versión GPU

Alfred — CPU

v0.3.0 • Sin GPU requerida • Windows 10+

Aceleración Solo CPU
Compatible con Windows x64
Descargar versión CPU

Pasos de Instalación

1

Instala Alfred

Ejecuta el instalador correspondiente a GPU o CPU, o extrae el ZIP portable

2

Abre Modelos

Busca un repositorio GGUF de Hugging Face o copia un GGUF en la carpeta de modelos

3

Descarga y selecciona

Elige una cuantización adecuada para tu RAM o VRAM y selecciona el modelo

4

¡Listo!

El modelo se carga al primer mensaje y la inferencia se realiza localmente

FAQ

Preguntas Frecuentes

¿Es realmente gratis?

Sí, Alfred es completamente gratis y de código abierto bajo Apache License 2.0. No hay costos ocultos, suscripciones ni límites de uso.

¿Necesito conexión a internet?

Solo para obtener Alfred y, si lo deseas, buscar o descargar un GGUF desde Hugging Face. Con un modelo local seleccionado, los chats funcionan sin internet.

¿Qué tan privado es realmente?

No hay telemetría y los prompts no se envían a un proveedor de IA. La pantalla Modelos sí se conecta a Hugging Face cuando buscas o descargas; los logs de diagnóstico permanecen locales.

¿Puedo usar mi GPU?

Sí, si tienes una GPU NVIDIA (Turing RTX 20xx o superior), descarga la versión GPU. Alfred usa CUDA nativo para acelerar la inferencia significativamente.

¿Qué formatos de documentos soporta?

Alfred extrae texto de PDFs mediante PDFium y puede adjuntar formatos basados en texto como TXT, Markdown, JSON, XML, CSV, HTML, YAML y logs.

¿Está disponible para Mac o Linux?

La aplicación de escritorio oficial se distribuye actualmente solo para Windows x64.