Si buscas una experiencia de escritorio dedicada con flujos de trabajo adicionales, consulta BasiliskLLM (aplicación independiente más un complemento mínimo para NVDA). AI-Hub sigue siendo una opción completa dentro de NVDA.

AI-Hub

AI-Hub es un complemento para NVDA que conecta tu lector de pantalla con varias API de modelos de lenguaje de gran escala (LLM). Úsalo para redactar, resumir, ayudar con traducciones, visión (imágenes y capturas de pantalla), consultas por voz, transcripción y cuadros de herramientas opcionales (TTS, OCR y más), sin salir de NVDA.

El nombre del paquete en NVDA sigue siendo openai (por compatibilidad con instalaciones existentes). El nombre visible que ves en menús y configuración es AI-Hub.

Funciones de un vistazo

Este complemento no incluye su propio comprobador de actualizaciones. Las actualizaciones se gestionan mediante la Tienda oficial de complementos de NVDA cuando instalas desde allí. Si instalas manualmente desde la página de versiones, instala del mismo modo las compilaciones .nvda-addon más recientes.

Proveedores compatibles

Configura uno o más proveedores en NVDA, en Preferencias -> Configuración -> AI-Hub. Cada proveedor puede tener varias cuentas con nombre (claves API, organización opcional o URL base, cuando corresponda).

Proveedor Función
OpenAI GPT y modelos relacionados; cuadros de herramientas oficiales de transcripción y TTS
DeepSeek API de DeepSeek (compatible con OpenAI)
OpenAI personalizado Cualquier API HTTP compatible con OpenAI (URL base personalizada + clave)
Ollama Modelos locales mediante endpoint compatible con OpenAI; herramienta de gestión de modelos
Mistral AI Mistral / Pixtral; herramientas de TTS Voxtral, OCR y voz a texto
OpenRouter Muchos modelos de terceros con una sola clave
Anthropic Claude
xAI Grok
Google Gemini; herramienta Lyria 3 Pro

El complemento puede tomar claves API de variables de entorno cuando están definidas (por ejemplo, OPENAI_API_KEY, DEEPSEEK_API_KEY, MISTRAL_API_KEY, OPENROUTER_API_KEY, ANTHROPIC_API_KEY, XAI_API_KEY, GEMINI_API_KEY / GOOGLE_API_KEY, entre otras). La interfaz de configuración sigue siendo el lugar principal para gestionar cuentas.

Motores de voz a texto (transcripción)

Para la transcripción de micrófono / archivo dentro del flujo principal (no la herramienta de transcripción separada de OpenAI), puedes elegir entre whisper_cpp (local), openai (API de Whisper) y mistral, en la sección Audio de la configuración de AI-Hub.

Instalación

  1. Abre la página de versiones del complemento.
  2. Descarga el paquete .nvda-addon más reciente.

Configuración inicial

  1. Abre NVDA -> Preferencias -> Configuración.
  2. Selecciona la categoría AI-Hub.
  3. En API Accounts, elige Add account....
  4. En el diálogo de cuenta, selecciona un proveedor, escribe un nombre de cuenta y completa los campos obligatorios (clave API para la mayoría de proveedores; URL base para Custom OpenAI y Ollama, y en Ollama se usa por defecto http://127.0.0.1:11434/v1 si está vacía).
  5. Guarda y, opcionalmente, añade más cuentas, edita las existentes o elimina las que no uses de la lista.
  6. Opcionalmente, ajusta Audio, Comentarios del chat, Avanzado / temperatura y Guardado automático de conversación (activado por defecto).

Hasta que al menos una cuenta de proveedor esté lista, al abrir el cuadro principal se te pedirá que añadas claves en la configuración de AI-Hub.

Actualizar desde versiones antiguas de "Open AI"

Si usaste una versión anterior de este complemento:

No necesitas mover archivos manualmente, salvo que uses una configuración personalizada.

Menú de NVDA: AI-Hub

En el menú de NVDA encontrarás AI-Hub (con la versión instalada en la etiqueta). Las opciones incluyen:

Cuadro principal

Ábrelo con NVDA+G o con Cuadro principal... en el menú de AI-Hub.

Qué puedes hacer

Opciones que dependen del modelo

Algunos controles solo aparecen o se aplican en ciertos modelos:

La disponibilidad exacta cambia a medida que los proveedores actualizan sus API; la interfaz refleja el modelo actualmente seleccionado.

Prompt del sistema

El prompt del sistema orienta el comportamiento del modelo. Se proporciona uno predeterminado adaptado a asistencia de accesibilidad; puedes editarlo, restablecerlo desde el menú contextual y, opcionalmente, conservar el último prompt usado (configurable en la configuración). El prompt del sistema consume tokens igual que cualquier otra entrada.

Historial de conversaciones

Usa Historial de conversaciones... desde el menú de AI-Hub, o asigna un gesto en Gestos de entrada -> AI-Hub.

Puedes listar, abrir, renombrar, eliminar y crear conversaciones. Desde el cuadro principal, F2 y Ctrl+N ayudan a gestionar la sesión actual.

Guardado automático

Si Guardado automático de conversación está activado en la configuración (predeterminado), el complemento guarda (o actualiza) la conversación almacenada después de cada respuesta completa del asistente, y puede conservar el estado al cerrar el cuadro si hay algo que guardar. También puedes guardar desde el menú contextual del campo Mensajes. Si el guardado automático está desactivado, usa el guardado manual cuando quieras conservarla.

Hacer una pregunta (voz)

Este comando no tiene tecla predeterminada. Asígnale una en Gestos de entrada -> AI-Hub.

Modos:

Si el cuadro principal está enfocado, se usa su modelo actual; en caso contrario, el complemento elige un modelo adecuado entre los proveedores configurados.

Submenú Herramientas

La entrada Herramientas en el menú de AI-Hub abre cuadros agrupados por proveedor (cada uno puede requerir la cuenta API correspondiente):

Área del menú Herramienta
Mistral Voxtral TTS..., OCR..., Voz a texto...
Google Lyria 3 Pro...
OpenAI TTS..., Transcripción / Traducción...
Ollama Gestor de modelos...

Si no hay una cuenta configurada para el proveedor de una herramienta, el complemento te indicará que añadas una en la configuración de AI-Hub.

Comandos globales

Todos los gestos predeterminados pueden cambiarse en NVDA -> Preferencias -> Gestos de entrada -> AI-Hub.

Gesto Acción
NVDA+G Mostrar el cuadro principal de AI-Hub
NVDA+E Capturar pantalla y describir (añade imagen a una sesión)
NVDA+O Describir la región actual del objeto navegador
(sin gesto predeterminado) Historial de conversaciones. Asígnalo en Gestos de entrada -> AI-Hub.
(sin gesto predeterminado) Hacer una pregunta (grabar / enviar / detener audio). Asígnalo en Gestos de entrada -> AI-Hub.
(sin gesto predeterminado) Alternar grabación de micrófono y transcripción. Asígnalo en Gestos de entrada -> AI-Hub.

Dónde se guardan los datos

Los archivos de trabajo, el índice de conversaciones guardadas, el archivo accounts.json unificado y los adjuntos se guardan en tu directorio de configuración de usuario de NVDA, en la carpeta aihub (después de la migración desde openai). Los archivos temporales usan una subcarpeta tmp y se limpian cuando corresponde (por ejemplo, al finalizar el complemento o al cerrar el cuadro de diálogo).

Dependencias requeridas (obtenidas automáticamente durante la compilación)

Las compilaciones usan scons para poblar las librerías de ejecución en:

addon/globalPlugins/AIHub/libs/

Cuando falta una librería requerida, scons descarga ruedas fijadas y extrae solo lo necesario en esa carpeta. Las dependencias fijadas actuales son:

El directorio libs está intencionalmente ignorado por git; quienes colaboran no necesitan confirmar artefactos incorporados.

Solución de problemas (breve)

Para incidencias y contribuciones, usa el enlace al repositorio de GitHub desde el menú de AI-Hub.