Vision Access — дополнение для описания изображений

Это дополнение позволяет пользователям NVDA описывать графическое содержимое на экране с помощью искусственного интеллекта. Вы можете использовать Ollama (локально) или Google Gemini AI.

Возможности

Горячие клавиши

Комбинация Функция
NVDA+Shift+E Описать визуальное содержимое навигационного объекта
NVDA+Shift+G Описать визуальное содержимое объекта с фокусом (графика, изображение)

Настройки

Чтобы открыть настройки: Меню NVDA → Параметры → Настройки → Vision Access

Выбор провайдера

Настройки Ollama

Настройки Gemini

Примечание: Чтобы получить ключ API Gemini, посетите Google AI Studio.

Требования

Для Ollama

Для Gemini

Использование

  1. Перейдите к визуальному элементу, который хотите описать (изображение, графика, область экрана)
  2. Нажмите NVDA+Shift+E или NVDA+Shift+G
  3. Слушайте уведомления о прогрессе (0%, 25%, 50%, 75%, 100%)
  4. Когда прозвучит «Описание готово», откроется диалог с результатом
  5. Используйте поле «Спросить ещё», чтобы задать уточняющие вопросы

Решение проблем

Ошибка подключения к Ollama: Убедитесь, что Ollama запущена (ollama serve)

Ошибка API Gemini: Проверьте, что ваш ключ API действителен и не превышен лимит запросов

Разработчик

Sarper Arıkan
Эл. почта: sarperarikan@gmail.com
Веб-сайт: sarperarikan.net