Google DeepMind представила курсор, который понимает объекты на экране - «Новости мира Интернет» » Новости мира Интернет
Mozilla тестирует новый дизайн браузера Firefox - «Новости мира Интернет»
Mozilla тестирует новый дизайн браузера Firefox - «Новости мира Интернет»
Autonomous выпустила NFC-ключ, который помогает меньше сидеть в соцсетях - «Новости мира Интернет»
Autonomous выпустила NFC-ключ, который помогает меньше сидеть в соцсетях - «Новости мира Интернет»
В навигаторе 2ГИС добавили возможность ориентироваться по маршруту без сигнала GPS - «Новости мира Интернет»
В навигаторе 2ГИС добавили возможность ориентироваться по маршруту без сигнала GPS - «Новости мира Интернет»
Google добавила в Gemini для Mac новые голосовые функции - «Новости мира Интернет»
Google добавила в Gemini для Mac новые голосовые функции - «Новости мира Интернет»
Google запускает проверку возраста для Android-приложений по всему миру - «Новости мира Интернет»
Google запускает проверку возраста для Android-приложений по всему миру - «Новости мира Интернет»
Keychron представила вертикальную мышь BM27 - «Новости мира Интернет»
Keychron представила вертикальную мышь BM27 - «Новости мира Интернет»
Anthropic представила Claude Opus 5 – новую ИИ-модель с производительностью флагманского уровня при меньших затратах - «Новости мира Интернет»
Anthropic представила Claude Opus 5 – новую ИИ-модель с производительностью флагманского уровня при меньших затратах - «Новости мира Интернет»
В Google Переводчике тестируют виджет для быстрого запуска синхронного перевода - «Новости мира Интернет»
В Google Переводчике тестируют виджет для быстрого запуска синхронного перевода - «Новости мира Интернет»
Apple выплатит $250 млн покупателям iPhone из-за задержки Apple Intelligence - «Новости сети»
Apple выплатит $250 млн покупателям iPhone из-за задержки Apple Intelligence - «Новости сети»
Anthropic внезапно выпустила Claude Opus 5 — почти как Fable 5, но по ценам на уровне предшественника - «Новости сети»
Anthropic внезапно выпустила Claude Opus 5 — почти как Fable 5, но по ценам на уровне предшественника - «Новости сети»
Новости мира Интернет » Новости интернета » Google DeepMind представила курсор, который понимает объекты на экране - «Новости мира Интернет»

Google и команда DeepMind представили концепцию ИИ-интерфейса, в котором обычный курсор мыши превращается в полноценный инструмент взаимодействия с Gemini.



Новая система позволяет ИИ понимать объект под курсором – изображение, текст, PDF-файл, таблицу или элемент интерфейса. Пользователю больше не нужно составлять длинные запросы в отдельном окне чат-бота. Вместо этого можно указать на объект и дать короткую команду: «сравни это», «объясни это» или «перемести в папку».



В DeepMind считают новый способ общения с ИИ более человеческим, так как жесты и контекст для пользователя зачастую важнее длинных объяснений. Например, система сможет распознать здание на фотографии и сразу построить маршрут, кратко пересказать выделенный PDF-документ или автоматически преобразовать таблицу в диаграмму. В одном из демонстрационных сценариев кадр из туристического видео превратился в ссылку на бронирование ресторана, который распознал Gemini.






Источник: Google (здесь и на обложке)



Разработчики выделяют четыре главных принципа концепции: работа ИИ без отвлечения от текущих задач, взаимодействие через контекст, использование коротких команд и превращение пикселей в интерактивные объекты.



Часть этих возможностей уже начинает появляться в Google Chrome. Пользователи смогут задавать Gemini вопросы о конкретной части страницы с помощью курсора. В будущем похожие функции появятся в устройствах Googlebook через систему Magic Pointer.


Google и команда DeepMind представили концепцию ИИ-интерфейса, в котором обычный курсор мыши превращается в полноценный инструмент взаимодействия с Gemini. Новая система позволяет ИИ понимать объект под курсором – изображение, текст, PDF-файл, таблицу или элемент интерфейса. Пользователю больше не нужно составлять длинные запросы в отдельном окне чат-бота. Вместо этого можно указать на объект и дать короткую команду: «сравни это», «объясни это» или «перемести в папку». В DeepMind считают новый способ общения с ИИ более человеческим, так как жесты и контекст для пользователя зачастую важнее длинных объяснений. Например, система сможет распознать здание на фотографии и сразу построить маршрут, кратко пересказать выделенный PDF-документ или автоматически преобразовать таблицу в диаграмму. В одном из демонстрационных сценариев кадр из туристического видео превратился в ссылку на бронирование ресторана, который распознал Gemini. Источник: Google (здесь и на обложке) Разработчики выделяют четыре главных принципа концепции: работа ИИ без отвлечения от текущих задач, взаимодействие через контекст, использование коротких команд и превращение пикселей в интерактивные объекты. Часть этих возможностей уже начинает появляться в Google Chrome. Пользователи смогут задавать Gemini вопросы о конкретной части страницы с помощью курсора. В будущем похожие функции появятся в устройствах Googlebook через систему Magic Pointer.

Цитирование статьи, картинки - фото скриншот - Rambler News Service.
Иллюстрация к статье - Яндекс. Картинки.
Есть вопросы. Напишите нам.
Общие правила  поведения на сайте.

запостил(а)
Аза
Вернуться назад
0

Смотрите также

А что там на главной? )))



Комментарии )))