Категории Нейросети и ИИ

Gemini вышел на Windows и получил доступ к содержимому открытых окон

Gemini вышел на Windows и получил доступ к содержимому открытых окон

Google запустила ИИ-приложение Gemini для Windows. Оно открывается поверх активного окна, анализирует видимое содержимое и подключается к сервисам Google, включая Gmail, Drive, Docs и Calendar. Версия доступна по всему миру на компьютерах с Windows 10 и Windows 11.

Gemini для Windows: работа с окнами и файлами

На Windows Gemini вызывается сочетанием Alt + Space. По умолчанию приложение появляется над текущей программой: пользователь может задать вопрос, проверить факт или подготовить текст, а затем вернуться к прежней задаче. Запуск также доступен через панель задач и значок в системном трее.

Приложение умеет получать контекст из конкретного окна. Для этого нужно открыть меню Add files and tools, выбрать Share window и указать окно, которое Gemini должен увидеть. Например, сервис может выделить три главных вывода из сложной диаграммы на экране или помочь с материалом из локального файла.

На macOS для мини-чата используется комбинация Option + Space, а полноэкранный чат открывается по Option + Shift + Space. Приложение также запускается через строку меню и Dock. Версия для Mac работает на компьютерах Apple Silicon с macOS Sequoia 15.0 или новее, а Windows-версия поддерживает x64- и Arm64-устройства.

Для чтения полных страниц в браузере на Mac потребуется отдельно разрешить Gemini доступ к функции Accessibility в настройках конфиденциальности macOS. История чатов и память синхронизируются между веб-версией, настольным приложением и мобильными устройствами, если на них выполнен вход в один аккаунт Google. Набор возможностей зависит от функции и региона.

Gemini работает на мультимодальной большой языковой модели, которая обрабатывает текст, аудио, изображения и другие типы данных. Google впервые представила сервис в марте 2023 года под названием Bard в экспериментальном режиме. В описании продукта компания также связывает его развитие с исследованиями Word2Vec 2013 года, диалоговыми нейросетевыми моделями 2015 года, архитектурой Transformer 2017 года и поддержкой многошагового диалога, представленной в 2020 году.

Читайте также:

Gemini Spark и подключённые сервисы

В настольном приложении доступен Gemini Spark — персональный ИИ-агент для многоэтапных задач. Ему можно поручить исследование, планирование или сведение данных, при этом пользователь сохраняет управление. Spark также может получать сведения из Gmail, Google Drive, Docs и Calendar: искать детали в переписке, пересказывать документы и сопоставлять записи со встречами.

На Mac Gemini Spark умеет работать с файлами и программами на компьютере. В качестве примера Google приводит сортировку PDF-файлов из папки Downloads по заданным каталогам и создание таблицы бюджета на основе последних счетов, сохранённых на устройстве. Агент получает доступ только к файлам, на использование которых пользователь дал разрешение.

Gemini Spark для macOS доступен в бета-версии подписчикам Google AI Ultra старше 18 лет в США. В дальнейшем Google планирует разрешить удалённый запуск задач с телефона. Среди примеров: поиск отчёта о продажах на Mac, извлечение показателя общей выручки и отправка результата по электронной почте.

Google расширила список приложений, подключаемых к Spark. Агент теперь поддерживает Google Tasks и Google Keep, поэтому может превращать заметки из Keep в задачи. Также заявлены интеграции с Canva, Dropbox, Instacart, OpenTable и Zillow Rentals. Они должны появиться в Spark для веба и мобильных устройств в течение недели, а в версии для macOS появятся в ближайшие недели.

Spark также получил поддержку пользовательского протокола Model Context Protocol, который позволяет подключать к агенту выбранные приложения. Сервису добавили отслеживание тем и реакцию на события в реальном времени: он может следить за блогами, новостными сайтами, социальными сетями, финансовыми данными, покупками, погодой, спортом и электронной почтой. В примерах Google упоминает уведомления после футбольного матча и отчёт при достижении акцией заданного значения.

Для творческих задач настольное приложение Gemini умеет генерировать изображения через Nano Banana и создавать видео с Gemini Omni. Google называет Windows-приложение лёгким и тихим в работе и обещает постепенно добавлять в него новые нативные функции. Дополнительные возможности для macOS уже доступны, а Windows будет получать их со временем. Ранее Google выпустила приложение для Windows на Galaxy Book.

Источник: Techspot
Опубликовано:
Елизавета Добровольская