مجموعِ دانلودها: +۶۱,۰۰۰
دستیارِ بینایی (Vision Assistant Pro) یک دستیارِ هوشِ مصنوعیِ پیشرفته و چندحالته برای NVDA است. این ابزار از برترین موتورهای هوشِ مصنوعیِ جهان برای ارائهی امکاناتِ هوشمندِ خواندنِ صفحه، ترجمه، تایپِ صوتی، و تحلیلِ اسناد استفاده میکند.
این افزونه به مناسبتِ روزِ جهانیِ افرادِ دارای معلولیت، جهتِ ادای احترام به جامعهی کاربرانِ NVDA منتشر شده است.
به منوی NVDA > اولویتها > تنظیمات > Vision Assistant Pro بروید. پنجرهی تنظیمات در ۸ زبانه دسترسیپذیر سازماندهی شده است: اتصال، رفتارِ هوشِ مصنوعی، زبانهای ترجمه، سندخوان، ویدیو، کپچا، پرامپتها، و پیشرفته.
[selection]، [screen_fg_obj]).برای تنظیمِ لاگگیریِ سراسریِ افزونه به زبانهی پیشرفته بروید:
- فعالسازیِ فایلِ لاگِ اختصاصی: فعالسازیِ لاگگیریِ تمامِ رویدادهای کاری، ترافیکِ API، و خطاها در یک فایلِ مجزا (vision_assistant.log).
- سطحِ لاگ: انتخابِ میزانِ جزئیات بین دیباگ (تمامِ جزئیات)، اطلاعات (اطلاعاتِ عمومی)، هشدار (فقط هشدارها)، و خطا (فقط خطاها).
- نگهداریِ لاگها به مدتِ: تنظیمِ بازههای نگهداریِ خودکار برای پاکسازیِ لاگهای قدیمیتر (از ۱ ساعت تا ۹۰ روز).
- کنترلهای مدیریتِ لاگ: استفاده از باز کردنِ فایلِ لاگ، باز کردنِ پوشهی لاگ، یا پاکسازیِ فایلِ لاگ جهتِ بررسی یا پاکسازیِ دادههای لاگ بدون نیاز به ریاستارتِ NVDA یا تداخل با لاگهای استانداردِ NVDA.
برای جلوگیری از تداخلِ صفحهکلید، این افزونه از یک لایهی فرمان استفاده میکند.
۱. کلیدهای NVDA + Shift + V (کلیدِ اصلی) را برای فعالسازیِ لایه فشار دهید (یک صدای بوق خواهید شنید).
۲. کلیدها را رها کرده، سپس یکی از تککلیدهای زیر را فشار دهید:
| کلید | عملکرد | توضیح |
|---|---|---|
| Shift + A | اپراتورِ هوشِ مصنوعی | عملیاتِ خودمختار: به هوشِ مصنوعی دستور دهید کاری را روی صفحهی شما انجام دهد. فشردنِ مجدد آن بلافاصله عملیات را لغو میکند. |
| E | کاوشگرِ رابطِ کاربری | کلیکِ تعاملی: عناصرِ رابطِ کاربری را در هر برنامهای شناسایی کرده و روی آنها کلیک میکند. |
| T | مترجمِ هوشمند | متنِ زیرِ مکاننمای پویشگر یا متنِ انتخابشده را ترجمه میکند. |
| Shift + T | مترجمِ کلیپبرد | محتوای فعلیِ کلیپبرد را ترجمه میکند. |
| R | پالایشکنندهی متن | خلاصهسازی، رفعِ ایراداتِ گرامری، توضیح، یا اجرای پرامپتهای سفارشی. |
| V | مشاهدهی بصریِ شیء | شیءِ پویشگرِ فعلی را توصیف میکند. |
| O | مشاهدهی بصریِ تمامصفحه | چیدمان و محتوای کلِ صفحه را تحلیل میکند. |
| Shift + V | تحلیلِ ویدیو | تحلیلِ فایلهای ویدیوییِ محلی یا ویدیوهای آنلاینِ YouTube، Instagram، TikTok، یا Twitter (X). |
| Control + V | ضبطِ ویدیوییِ محلی | یک ویدیوی بی صدا از صفحهی شما ضبط کرده و اقدامات و چیدمان را تحلیل میکند. |
| D | سندخوان | خوانندهی پیشرفته برای فایلهای PDF و تصاویر با امکانِ انتخابِ محدوده صفحات. |
| F | عملیاتِ هوشمندِ فایل | تشخیصِ مبتنی بر زمینه از روی فایلهای تصویر، PDF، یا TIFF انتخابشده. |
| M | پیادهسازی و دوبلهی رسانه | پیادهسازی یا دوبلهی فایلهای صوتی/ویدیویی (MP3, WAV, MP4 و غیره) به زبانِ مقصدِ شما. |
| C | حلکنندهی کپچا | کپچا را دریافت کرده و حل مینماید. |
| Shift + C | چتِ مستقیم | یک پنجرهی چتِ متنیِ مستقیم با هوشِ مصنوعی باز میکند. |
| S | تایپِ صوتیِ هوشمند | گفتار را به متن تبدیل میکند. برای شروعِ ضبط یک بار، و برای توقف/تایپ مجدداً بزنید. |
| Control + T | ترجمهی صدایی | بر اساسِ تنظیماتِ زبانِ شما، گفتار را پیادهسازی، ترجمه و نتیجه را تایپ میکند. |
| Control + L | دستیارِ زنده | دستیارِ تعاملیِ زنده (فقط Gemini): یک گفتگوی صوتی و تصویریِ زنده و همزمان با هوشِ مصنوعی را شروع یا تمام میکند. |
| I | اعلامِ وضعیت | وضعیتِ فعلیِ پیشرفت را اعلام میکند (مانند «در حالِ اسکن...»، «بیکار»). |
| L | برچسبگذاریِ شیء | برچسبگذاریِ معناییِ هوشِ مصنوعی: عنصر یا آیکونِ فوکوسشدهی فعلی را بهطور دائمی برچسبگذاری میکند. |
| Shift + L | مدیریت/اسکنِ برچسبها | پنجرهی مدیریتِ برچسبها را باز میکند یا کلِ برنامه را برای عناصرِ بدوننام اسکن مینماید. |
| U | بررسیِ بهروزرسانی | بررسیِ دستیِ گیتهاب برای دریافتِ آخرین نسخهی افزونه. |
| Space | فراخوانیِ آخرین نتیجه | آخرین پاسخِ هوشِ مصنوعی را در پنجرهی چت برای بررسی یا پیگیری نمایش میدهد. |
| H | راهنمای فرمانها | فهرستی از تمامِ میانبرهای موجود را نمایش میدهد. |
| Alt + S | تنظیمات | پنجرهی تنظیماتِ دستیارِ بینایی را باز میکند. |
| Alt + Q | گزارشِ کلیدهای تمامشده | تعدادِ کلیدهای API جمینای که از سهمیهی روزانهی خود فراتر رفتهاند و زمانِ بازنشانیِ آنها را گزارش میدهد. |
| Alt + M | ممیزیِ مسیریابی | مدلهای هوشِ مصنوعیِ انتخابشده در مسیریابیِ پیشرفته را گزارش میدهد. |
| جهتنما بالا / پایین | پیمایشِ تنظیماتِ سریع | بین دستهبندیهای تنظیماتِ سریع (ارائهدهنده، مدل و غیره) در لایه پیمایش میکند. |
| جهتنما چپ / راست | تغییرِ تنظیمِ سریع | مقدارِ تنظیمِ سریعِ انتخابشدهی فعلی را تغییر میدهد. |
اپراتورِ هوشِ مصنوعی دستیارِ بینایی را از یک خوانندهی غیرفعال به یک دستیارِ فعال تبدیل میکند که میتواند به نیابت از شما با رایانهتان کار کند. میتوانید از آن بخواهید صفحه را توصیف کند، به پرسشهای شما دربارهی آنچهمیبیند پاسخ دهد، یا حتی کنترل را در دست بگیرد—با کلیک روی دکمهها، کشیدنِ آیتمها، تایپِ متن، و پیمایش در برنامهها با دستوراتِ زبانِ طبیعی.
بزرگترین مزیت؟ این ابزار در نرمافزارهای کاملاً دسترسیناپذیر به زیبایی کار میکند. اگر در یک برنامهی خاص، ریموت دسکتاپ، یا وبسایتی هستید که صفحهخوانِ شما کاملاً سکوت کرده، اپراتور مشکلی ندارد. چون صفحه را به صورت بصری «میبیند»، میتواند عناصری که هیچ برچسبِ دسترسیپذیری ندارند را پیدا کرده، بخواند و با آنها کار کند.
اپراتور طیفِ وسیعی از دستورات را درک میکند:
- توصیف و پاسخ: «چیدمان صفحه رو توصیف کن» یا «پیام خطا چیه؟»
- کلیک: «روی دکمه ذخیره کلیک کن»
- راستکلیک: «روی فایل راستکلیک کن»
- دوبارکلیک: «روی سند دبلکلیک کن»
- کشیدن و رها کردن (Drag & Drop): «سند رو بکش داخل پوشه Archive»
- تایپ: «عبارت سلام رو داخل کادر جستجو تایپ کن»
- اسکرول: «سه بار برو پایین»
- فشردن کلید: «کلید اینتر رو بزن»، «کلید تاب رو بزن»
- کارهای چندمرحلهای: «فایل اکسپلورر رو باز کن، گزارش رو پیدا کن و اسمش رو به final.pdf تغییر بده»
نکته: قابلیتهای تحلیلِ ویدیو و توصیفِ صوتی منحصراً توسط ارائهدهندهی Google Gemini پشتیبانی میشوند. مطمئن شوید ارائهدهندهی فعالِ شما در تنظیمات روی Google Gemini باشد.
دستیارِ بینایی امکاناتِ ویدیوییِ قدرتمندی را مخصوصِ کاربرانِ نابینا ارائه میدهد. این ابزار میتواند هم ویدیوهای آنلاین و هم ضبطهای ویدیوییِ محلی از صفحه را تحلیل کرده، توصیفهای بصریِ مفصلی ارائه دهد و فیلمنامههای حرفهایِ توصیفِ صوتی (SRT) تولید کند.
اگر با یک ویدیوی بیصدا، انیمیشن یا آموزش روی صفحهتان مواجه شدید، میتوانید آن را مستقیماً ضبط کنید:
۱. کلیدهای NVDA + Shift + V را بزنید تا واردِ لایهی فرمان شوید، سپس Control + V را فشار دهید.
۲. افزونه بهطور بیصدا در پسزمینه از صفحهی شما ویدیو ضبط خواهد کرد.
۳. مجدداً Control + V را بزنید تا ضبط متوقف شود.
۴. سپس هوشِ مصنوعی بخشِ ویدیوییِ ضبطشده را تحلیل کرده و توصیفِ بسیار مفصلی از صحنه، شخصیتها و اقدامات ارائه میدهد.
میتوانید هم فایلهای ویدیوییِ محلی و هم ویدیوهای آنلاین را تحلیل کنید. کافیست یک فایلِ ویدیوی محلی را در فایل اکسپلورر انتخاب کنید، یا لینکِ ویدیوی آنلاین را در کلیپبرد کپی نمایید. همچنین میتوانید در هر کجا کلیدهای Shift + V را بزنید تا کادرِ گفتگویی باز شود که در آن فایل را انتخاب کرده یا لینک را وارد کنید.
- پلتفرمهای آنلاینِ پشتیبانیشده: یوتیوب، اینستاگرام، تیکتاک و توییتر (X).
- هوشِ مصنوعی فایلِ محلی یا لینک را بهطور خودکار تشخیص داده، ویدیو را پردازش میکند و توصیفِ بصریِ کامل و خلاصهی صوتی ارائه میدهد.
برای یک تجربهی ساختاریافتهتر، افزونه میتواند فیلمنامههای توصیفِ صوتیِ حرفهای با فرمتِ استاندارد SubRip (SRT) تولید کند.
- زمانبندیِ هوشمندِ فواصل: هوشِ مصنوعی به خطِ صوتی گوش میدهد و توصیفهای بصریِ خود را دقیقاً در سکوتها و فواصلِ طبیعیِ بینِ گفتارها قرار میدهد تا تداخل با مکالمات به حداقل برسد.
- ردیابیِ شخصیتها: موتور یک مرحلهی پیشپردازش برای استخراجِ شخصیتهای مجزا بر اساسِ ویژگیهای چهره انجام میدهد. این سیستم یک دیکشنریِ سراسری میسازد تا شخصیتها را در صحنههای مختلف بدون اشتباه ردیابی و برچسبگذاری کند.
- استخراجِ دقیقِ متون (OCR): هر متنی که روی صفحه ظاهر شود (تابلوها، گوشیها، تیتراژ) دقیقاً به صورت کلمه به کلمه استخراج میشود.
- نحوه استفاده: برای گوش دادن به زیرنویسِ تولیدشده، کافیست فایلِ .srt را با همان نامِ دقیقی که فایلِ ویدیویی دارد در کنارِ آن قرار دهید. سپس پخشکنندهی خود (مانند VLC یا PotPlayer) را تنظیم کنید تا متنِ زیرنویس را مستقیماً به صفحهخوان یا موتورِ TTS شما ارسال کند.
فراتر از ساختِ فایلهای SRT، این افزونه با ترکیبِ گویندگیِ صوتی روی ویدیو به عنوان یک ابزارِ کاملِ تولیدِ توصیفِ صوتی عمل میکند. اکنون میتوانید Gemini Live TTS را به عنوانِ موتورِ صوتی انتخاب کنید که از Gemini Live API برای گویندگیِ فوقالعاده طبیعی و بدون محدودیت استفاده میکند. هنگامِ ساختِ MP3 برای فایلهای محلی، چند حالتِ میکس در اختیار دارید:
- توصیفِ صوتیِ استاندارد (میکسِ صدا): گویندگی مستقیماً روی صدای اصلیِ ویدیو قرار میگیرد. از شما پرسیده میشود که آیا مایل به اعمالِ کاهشِ صوتی (Ducking) هستید یا خیر (کم کردنِ صدای پسزمینه هنگامِ گویندگی).
- توصیفِ صوتیِ گسترشیافته (توقفِ صوت): موتور در زمانِ پخشِ گویندگی صدای اصلیِ ویدیو را متوقف میکند تا هیچ کلمهای از فیلم یا توصیف را از دست ندهید.
- ویدیوهای یوتیوب: برای منبعهای یوتیوب (که به صورت محلی دانلود نمیشوند)، فایلِ MP3 خروجی منحصراً شاملِ صوتِ گویندگیِ هوشِ مصنوعی خواهد بود.
بخشِ پیادهسازیِ صوتی بهطور کامل بازنویسی شده تا هم از فایلهای صوتی و هم ویدیویی (MP3, WAV, MP4, MKV و غیره) پشتیبانی کند. در لایهی فرمان کلید M را بزنید تا فایلِ رسانه را انتخاب کرده و از بین ۳ حالت یکی را برگزینید:
۱. پیادهسازی (زبانِ اصلی): گفتارِ پیادهسازیشده را به زبانِ اصلی استخراج میکند.
۲. پیادهسازی و ترجمه (زبانِ مقصد): گفتار را پیادهسازی کرده و به زبانِ مقصدِ شما ترجمه میکند.
۳. دوبله و ترجمه (زبانِ مقصد) (فقط Gemini): قابلیتِ جدید و قدرتمندی که گفتار را پیادهسازی، ترجمه و با صدای TTS افزونه دوبله میکند.
دستیارِ بینایی شامل یک سندخوانِ فوقالعاده بهینهشده برای PDFهای چندصفحهای، تصاویرِ پیچیده و حتی فرمتِ HEIC آیفون است.
نیازی نیست یک سندِ غولپیکر را یکباره بخوانید. محدوده صفحات را وارد کنید (مثلاً 1-20)، هوشِ مصنوعی تمامِ صفحات را در پسزمینه پردازش میکند. اگر NVDA بستهشود یا اسکن را متوقف کنید، افزونه پیشرفتِ شما را به خاطر سپرده و پیشنهاد میدهد از همانجایی که متوقف شده بود ادامه دهید!
همیشه نیازی نیست ابتدا سند را باز کنید. در فایل اکسپلوررِ Windows، کافیست یک PDF یا تصویر را انتخاب کرده و در لایهی فرمان کلید D (سندخوان) یا F (عملیاتِ هوشمندِ فایل) را بزنید. افزونه فوراً پنجرهی انتخابِ فایل را دور زده و شروع به پردازشِ آن میکند.
وقتی پنجرهی سندخوان باز است، میتوانید از میانبرهای زیر استفاده کنید:
- Ctrl + PageDown: رفتن به صفحهی بعدی.
- Ctrl + PageUp: رفتن به صفحهی قبلی.
- Alt + A: باز کردنِ پنجرهی چت برای پرسش دربارهی محتوای سند.
- Alt + R: اجبار به اسکنِ مجدد با هوشِ مصنوعی توسط ارائهدهندهی فعلی.
- Alt + G: تولید و ذخیرهی فایلِ صوتیِ باکیفیت (WAV/MP3). (اگر ارائهدهنده از TTS پشتیبانی نکند پنهان است).
- Alt + S / Ctrl + S: ذخیرهی متنِ استخراجشده به صورت فایلِ TXT یا HTML.
در برنامهای گیر کردهاید که همه جا «دکمهی بدون برچسب» میگوید؟ موتورِ برچسبگذاریِ معناییِ هوشِ مصنوعی این مشکل را برای همیشه حل میکند.
صفحهخوانِ خود را روی یک آیکون یا دکمهی بدون برچسب قرار داده و در لایهی فرمان کلید L را بزنید. هوشِ مصنوعی دکمه را به صورت بصری بررسی کرده، کارکردِ آن را تشخیص داده و یک برچسبِ دائمی اعمال میکند.
برخلافِ ابزارهای قدیمیِ برچسبگذاری، این افزونه از سیستمِ پیشرفتهی هیبریدیِ «امضای شیء» (AutomationId/ControlID) استفاده میکند. برچسبهای شما با تغییرِ اندازهی پنجره، جابهجاییِ مانیتور و بهروزرسانیِ برنامهها باقی میمانند!
کلیدهای Shift + L را بزنید تا کلِ پنجرهی فعال یکباره اسکن شود. هوشِ مصنوعی تمامِ عناصرِ بدوننام را پیدا کرده و در یک نوبت نامگذاری میکند. بعداً میتوانید این برچسبها را در مدیریتِ برچسبها مدیریت، ویرایش یا حذف کنید.
میخواهید بدونِ پیمایشِ دستی با یک عنصر کار کنید؟ کلید E را بزنید تا کاوشگرِ UI فعال شود. هوشِ مصنوعی صفحه را اسکن کرده و لیستی دسترسیپذیر از تمامِ عناصرِ قابلِ کلیک (بدون مواردِ اضافیِ سیستم مثل نوارِ وظایف) ارائه میدهد. یک مورد را انتخاب کنید تا افزونه فوراً روی آن کلیک کند.
دستیارِ زنده افزونه را به یک دستیارِ تعاملی و همزمان در کنارِ شما تبدیل میکند.
(نکته: این قابلیت منحصراً برای Google Gemini و ارائهدهندگانِ دلخواه با نوعِ Gemini است).
میتوانید پرامپتها را در تنظیمات > پرامپتها > مدیریتِ پرامپتها... مدیریت کنید.
[selection]: متنِ انتخابشدهی فعلی.[clipboard]: محتوای کلیپبرد.[clipboard_image]: تصویرِ فعلیِ موجود در کلیپبرد.[screen_obj]: اسکرینشات از شیءِ پویشگر.[screen_fg_obj]: اسکرینشات از پنجرهی فعالِ روبرو.[screen_full]: اسکرینشات از تمامِ صفحه.[file_ocr]: انتخابِ تصویر/PDF برای استخراجِ متن.[file_read]: انتخابِ سند برای خواندن (TXT, کد, PDF).[file_audio]: انتخابِ فایلِ صوتی برای تحلیل (MP3, WAV, OGG).{target_lang}: زبانِ مقصدِ فعلی.{source_lang}: زبانِ مبدأِ فعلی.{response_lang}: زبانِ پاسخِ فعلیِ هوشِ مصنوعی.{swap_target}: زبانِ پشتیبان برای ترجمهی جابهجاییِ هوشمند.{swap_instruction}: بلوکِ دستورِ ترجمهی جابهجاییِ هوشمند.دستیارِ بینایی مملو از ابزارهای پیشرفته است. در ادامه چند سناریوی رایج برای انتخابِ ابزارِ مناسب آمده است:
سناریو: میخواهید چیدمانِ کاملِ یک پنجرهی پیچیده یا برنامهی دسترسیناپذیر را درک کنید.
راهکـار: کلید O (مشاهدهی بصریِ تمامصفحه) را بزنید. هوشِ مصنوعی کلِ صفحه را تحلیل کرده و موقعیتِ دقیقِ عناصر، متون و دکمهها را توصیف میکند.
سناریو: تصویری در یک صفحه وب یا گرافیکِ بدوننامی در یک سند پیدا کردهاید.
راهکـار: شیءِ پویشگر را روی آن قرار داده و V (مشاهدهی بصریِ شیء) را بزنید. هوشِ مصنوعی محتوای تصویر را توصیف خواهد کرد.
سناریو: میخواهید یک فیلم یا ویدیو را همراه با توصیفِ صوتی ببینید.
راهکـار: روی ویدیو کلیدهای Shift + V را زده و «تولیدِ توصیفِ صوتی (فایلِ SRT)» را انتخاب کنید. پس از اتمام، روی «تولیدِ گویندگیِ همگام (MP3)» کلیک کرده و «توصیفِ صوتیِ گسترشیافته» را انتخاب کنید.
سناریو: با برنامهای پر از «دکمههای بدون برچسب» مواجه شدهاید.
راهکـار: کلید L را برای برچسبگذاریِ دائمیِ دکمه با هوشِ مصنوعی بزنید. یا Shift + L را بزنید تا کلِ پنجره یکباره برچسبگذاری شود. اگر فقط میخواهید سریع کلیک کنید، E (کاوشگرِ UI) را بزنید.
سناریو: نیاز دارید یک کپچای دسترسیناپذیر را رد کنید.
راهکـار: کلید C (حلکنندهی کپچا) را بزنید. هوشِ مصنوعی کپچا را به صورت خودکار دریافت کرده، حل میکند و پاسخ را کادرِ مربوطه وارد مینماید.
سناریو: میخواهید یک سندِ PDF طولانیِ ۵۰ صفحهای را بخوانید.
راهکـار: کلید D (سندخوان) را زده، ارائهدهنده را روی Google Gemini بگذارید و محدوده را 1-50 وارد کنید. افزونه متن را با دقت در پسزمینه استخراج خواهد کرد.
سناریو: در حالِ تماشای یک آموزشِ ویدیوییِ بیصدا یا انیمیشن روی صفحه هستید.
راهکـار: کلیدهای Control + V را بزنید تا ضبطِ ویدیو شروع شود. بگذارید آموزش پخش شود، سپس مجدداً Control + V را بزنید. هوشِ مصنوعی اتفاقات را توصیف میکند.
سناریو: با یک خطای غیرمنتظره مواجه شدهاید یا میخواهید اتصالِ سرورهای محلی را دیباگ کنید.
راهکـار: به تنظیمات > پیشرفته بروید، «فعالسازیِ فایلِ لاگِ اختصاصی» را تیک بزنید و سطحِ لاگ را روی «دیباگ» قرار دهید. مجدداً کار را انجام داده و «باز کردنِ فایلِ لاگ» را بزنید.
نکته: برای تمامِ قابلیتهای هوشِ مصنوعی به اینترنت فعال نیاز است. اسنادِ چندصفحهای بهطور خودکار پردازش میشوند.
از آخرین اخبار، قابلیتها و نسخهها باخبر شوید:
- کانالِ تلگرام: t.me/VisionAssistantPro
- گزارشهای GitHub Issues: برای گزارشِ باگها و درخواستهای قابلیتهای جدید.
هنگامِ ثبتِ Issue در گیتهاب یا درخواستِ پشتیبانی، لطفاً جزئیاتِ ارائهدهندهی فعلی، مدل و نسخهی NVDA خود را ذکر کنید. اگر با مشکلِ اتصال یا کرش مواجه هستید، لاگِ اختصاصی را در تنظیمات > پیشرفته فعال کرده و فایلِ vision_assistant.log را ضمیمه نمایید.
سپاسِ صمیمانه از اعضای جامعهی کاربران که با کمکهای مالیِ سخاوتمندانهشان از توسعه و نگهداریِ مستمرِ این پروژه حمایت میکنند:
UQDd...CnMY)اگر مایلید از پروژه حمایتِ مالی کرده و نامِ خود را در اینجا ببینید، میتوانید گزینهی حمایتِ مالی را در منوی ابزارهای NVDA (منوی فرعیِ دستیارِ بینایی) یا در مراحلِ راهاندازی پس از نصب پیدا کنید.
Insert+Shift+V) اکنون پایدار و تعاملی است! میتوانید از کلیدهای جهتنمای بالا/پایین برای پیمایش بین تنظیماتِ سریع و از چپ/راست برای تغییرِ فوریِ مقادیر استفاده کنید.Shift+C): کلیدِ جدیدی به لایه اضافه شد! با فشردنِ Shift+C فوراً پنجرهی چتِ متنی با هوشِ مصنوعی باز میشود.Space برطرف شد. اکنون تاریخچهی گفتگو بهطور کامل حفظ میشود.Control+T): قابلیتِ جدید برای ضبطِ صدا، پیادهسازی و ترجمهی فوری و تایپِ آن با هوشِ مصنوعی بر اساسِ تنظیماتِ زبان.vision_assistant.log.