NVDA AI Ассистент

Практичное дополнение с ИИ-ассистентом для NVDA, которое добавляет функции создания сводок, чата, понимания снимков экрана и контекстного взаимодействия непосредственно в NVDA.

Обзор

NVDA AI Ассистент помогает работать с:

не покидая NVDA.

Дополнение сочетает быстрые действия с постоянным рабочим процессом чата, позволяя сводкам, снимкам экрана и содержимому страниц естественно переходить в последующие обсуждения.

Для полностью локального вывода оно также может запускать LiteRT-LM — автономную среду выполнения на устройстве, которая загружается по требованию; не требуется отдельной установки Python или Ollama.


Возможности

Создание сводок

Создание сводок для:

Быстрые действия могут непосредственно переходить в чат для последующего взаимодействия или открывать результат в совершенно новом разговоре (действия Добавить в чат / Открыть в новом чате).


Изображения и снимки экрана

Поддерживаемые форматы:


Чат

Пользовательский интерфейс чата на основе WebView поддерживает:

Вы можете:


Внедрение контекста

Добавление дополнительного контекста в активный разговор.

Содержимое страницы

Внедрение:

непосредственно в чат.

Чат со снимками экрана

Захват текущего экрана и его прикрепление к активному разговору.


Поддержка поставщиков

Поддерживаются:

Унифицированный адаптер, совместимый с OpenAI, также работает с любым другим сервером, поддерживающим протокол /v1/chat/completions (например, сервер llama.cpp).

Возможности включают:

Поставщиков и модели можно менять непосредственно из интерфейса чата без перезапуска разговора или из слоя ассистента с помощью T / M с последующей цифрой.


LiteRT-LM (локальный вывод)

LiteRT-LM — это автономная среда выполнения для локального вывода. Дополнение загружает её по требованию, поэтому вы можете запускать модели на своём компьютере без установки Python или Ollama:

Рекомендуемые модели LiteRT-LM включают Gemma 4 E2B/E4B и Qwen3 1.7B/4B/8B.


Режим мышления

Некоторые поставщики и модели (включая большинство моделей LiteRT-LM и Qwen3) поддерживают дополнительный режим мышления для расширенных рабочих процессов рассуждения.


Быстрый старт

Требования


Использование Ollama

Установка Ollama:

powershell id="55n8ws" winget install Ollama.Ollama

Загрузка модели:

powershell id="oaq6xv" ollama pull gemma4:e4b

или:

powershell id="b7xti3" ollama pull ministral-3:3b

Список установленных моделей:

powershell id="d62g3n" ollama ls


Настройка

  1. Установите дополнение NVDA AI Ассистент.
  2. Откройте панель настроек AI Ассистента.
  3. Используйте Управление поставщиками ИИ, чтобы включить поставщика, установить среду выполнения LiteRT-LM при необходимости и установить активного поставщика.
  4. Выберите модель или конечную точку.
  5. Нажмите NVDA+Shift+A, чтобы начать использование ассистента.

Совет: используйте Настроить активную модель для настройки параметров дискретизации для каждой модели (контекстное окно, температура, top-k, top-p, максимальное количество токенов, штраф за повторения).


Команды

Нажмите:

text id="7h19nm" NVDA+Shift+A

Затем нажмите:

Клавиша Действие
C Открыть чат
S Создать сводку текущего содержимого
O Создать сводку структуры страницы
I Описать текущее окно
F Описать объект в фокусе
P Прикрепить содержимое страницы к чату
X Прикрепить снимок экрана к чату
Z Прикрепить изображение объекта в фокусе к чату
V Прикрепить выделенный текст к чату
B Прикрепить содержимое буфера обмена к чату
T Выбрать поставщика (затем цифру)
M Выбрать модель (затем цифру)
H Справка

Нажмите T или M, чтобы услышать доступных поставщиков или модели с цифрами, затем нажмите цифру для мгновенного переключения.


Сочетания клавиш в чате

Следующие сочетания клавиш доступны в окне чата:

Сочетание Действие
Escape Скрыть окно чата (потоковая передача продолжается в фоновом режиме)
Alt+I Переместить фокус в поле ввода сообщения
Alt+S Отправить текущее сообщение
Shift+Enter Вставить новую строку в поле ввода сообщения
Alt+T Скопировать текст ответа в буфер обмена
Alt+K Скопировать ответ в формате Markdown
Alt+R Очистить текущее представление
Alt+L Переместить фокус в область содержимого ответа
Alt+P Переместить фокус на выбор поставщика
Alt+M Переместить фокус на выбор модели
Alt+A Прикрепить файл изображения

Настройка

Панель настроек позволяет вам:


Рекомендуемые локальные модели

Ollama

Модель Использование
ministral-3:3b Общий локальный чат и зрение
gemma4:e2b Лёгкое мышление
gemma4:e4b Более мощное мышление и понимание изображений
llama3.2:1b Лёгкий вывод на CPU

Просмотр сведений о модели с помощью:

powershell id="p2owd8" ollama show gemma4:e4b

LiteRT-LM

Загрузите эти модели из менеджера моделей (Hugging Face). Доступны варианты для CPU и GPU/NPU, где это указано.

Модель Использование
gemma-4-e2b Лёгкая модель для зрения и языка (CPU / GPU / NPU)
gemma-4-e4b Более мощная модель для зрения и языка (CPU / GPU)
qwen3-1.7b Лёгкая модель для мышления (режим мышления)
qwen3-4b Сбалансированная модель, конкурентоспособна с Gemma 4 E4B
qwen3-8b Более мощное мышление на больших настольных системах

Технические примечания


Устранение неполадок


Открытый исходный код и вклад

Приветствуются сообщения о проблемах, предложения, отзывы о доступности и запросы на включение изменений.


Лицензия

Сведения о лицензии см. в файле COPYING.txt.