Открыть сервис

Glass AI

Glass AI — это система искусственного интеллекта, разработанная компанией Google (принадлежит холдингу Alphabet Inc.) для помощи пользователям в повседневных задачах через носимые устройства, в первую очередь — через очки дополненной реальности Google Glass. Система объединяет в себе функции голосового ассистента, компьютерного зрения и генеративного искусственного интеллекта, позволяя взаимодействовать с информацией и окружающим миром без использования рук.

История

Разработка и ранние прототипы

Первые упоминания о Glass AI относятся к началу 2010-х годов, когда Google начала работу над проектом Google Glass. Изначально система базировалась на ограниченном наборе команд и простых алгоритмах распознавания речи. В 2013 году была выпущена бета-версия для разработчиков, а в 2014 году — коммерческая версия для потребителей. Однако из-за высокой цены, ограниченной функциональности и опасений по поводу конфиденциальности проект не получил широкого распространения.

Эволюция в корпоративном сегменте

После сворачивания потребительской версии в 2015 году Google сосредоточилась на корпоративном использовании Glass. В 2017 году была выпущена версия Google Glass Enterprise Edition 2, которая использовалась в промышленности, логистике и медицине. В этот период система AI была значительно улучшена: добавлены функции распознавания объектов, голосовые подсказки и интеграция с корпоративными базами данных.

Внедрение генеративного ИИ

В 2023 году, на фоне бума генеративных нейросетей, Google объявила о масштабном обновлении Glass AI. Система получила доступ к большим языковым моделям (LLM), таким как Gemini, что позволило ей отвечать на сложные вопросы, генерировать текст и переводить речь в реальном времени. В 2024 году были представлены прототипы Glass AI с возможностью визуального поиска и анализа изображений.

Архитектура и компоненты

Аппаратное обеспечение

Glass AI работает на базе носимого компьютера, встроенного в оправу очков. Основные компоненты:

  • Процессор: специализированный чип для обработки нейросетей (например, Tensor Processing Unit в последних версиях).
  • Дисплей: прозрачный микродисплей, проецирующий изображение в поле зрения пользователя (технология waveguide).
  • Камера: высокоразрешающая камера с углом обзора до 120 градусов для захвата изображений и видео.
  • Микрофоны и динамики: массив микрофонов для шумоподавления и стереодинамики для голосовой обратной связи.
  • Датчики: акселерометр, гироскоп, магнитометр, датчик освещённости и инфракрасный датчик для отслеживания взгляда.

Программное обеспечение

Операционной системой для Glass AI является модифицированная версия Android (Google Glass OS). Ключевые программные компоненты:

  • Голосовой ассистент Google Assistant: обрабатывает голосовые команды, отвечает на вопросы, управляет устройствами умного дома.
  • Модуль компьютерного зрения: распознаёт объекты, лица, текст, жесты и сцены, используя нейросети (например, Google Lens).
  • Генеративный ИИ (Gemini): отвечает за сложные диалоги, написание текстов, перевод и анализ данных.
  • Облачная интеграция: данные обрабатываются на серверах Google (Alphabet Inc.), что обеспечивает доступ к актуальной информации и моделям.

Функциональные возможности

Голосовое управление и ассистент

Glass AI позволяет выполнять типичные задачи голосового ассистента: отправка сообщений, установка напоминаний, поиск информации в интернете, управление календарём и навигация. В отличие от смартфона, все операции выполняются без отвлечения на экран.

Компьютерное зрение

Система способна в реальном времени распознавать объекты, лица, текст и QR-коды. Например, в промышленности Glass AI может идентифицировать детали на конвейере, а в медицине — отображать информацию о пациенте при сканировании его бейджа.

Генерация и перевод

С помощью Gemini Glass AI может:

  • переводить речь с одного языка на другой с отображением субтитров на дисплее;
  • генерировать краткие сводки текстов и документов;
  • отвечать на сложные вопросы, требующие анализа контекста;
  • создавать заметки, списки дел и черновики писем.

Навигация и дополненная реальность

Glass AI может проецировать на дисплей стрелки, названия улиц и расстояния до цели, что особенно полезно для пешеходов, велосипедистов и курьеров. В режиме дополненной реальности система может накладывать информацию на реальные объекты (например, отображать цену товара при взгляде на него).

Применение

Промышленность и логистика

Glass AI активно используется на заводах и складах. Рабочие получают инструкции, схемы и предупреждения прямо в поле зрения, что снижает количество ошибок и ускоряет обучение. Например, на предприятиях Boeing и DHL сотрудники используют Glass для сборки и сортировки.

Медицина

Врачи и медсёстры применяют Glass AI для доступа к электронным медицинским картам, просмотра снимков МРТ и рентгенограмм, а также для удалённых консультаций. В операционных системах может отображать жизненно важные показатели пациента.

Образование

В учебных заведениях Glass AI используется для интерактивных уроков: студенты могут видеть 3D-модели, а преподаватели — получать обратную связь от системы. В лабораториях система помогает выполнять сложные эксперименты, показывая пошаговые инструкции.

Повседневное использование

Хотя потребительская версия Glass AI не получила широкого распространения, отдельные пользователи применяют её для съёмки видео, навигации, чтения уведомлений и быстрого поиска информации. В 2024 году Google анонсировала новую версию для потребителей с улучшенной конфиденциальностью и дизайном.

Критика и ограничения

Конфиденциальность

Основной проблемой Glass AI остаётся нарушение приватности. Встроенная камера и микрофон могут записывать окружающих без их согласия, что вызвало протесты в общественных местах (например, в кинотеатрах и кафе). В ответ Google добавила индикатор записи (светодиод) и возможность отключения камеры.

Технические ограничения

  • Время автономной работы: батарея Glass AI рассчитана на 4–6 часов активного использования, что недостаточно для полного рабочего дня.
  • Вес и дизайн: ранние версии были громоздкими и вызывали дискомфорт при длительном ношении.
  • Цена: стоимость корпоративных версий превышает 1000 долларов США, что ограничивает массовое внедрение.

Социальные аспекты

Использование Glass AI в общественных местах может вызывать недоверие и подозрения. Некоторые заведения (например, бары и рестораны) ввели запрет на ношение устройства. Кроме того, система может отвлекать пользователя от реального общения, создавая «цифровой барьер».

Перспективы развития

Google продолжает инвестировать в Glass AI, интегрируя его с другими продуктами (например, Google Maps, YouTube, Gmail). Ожидается, что в ближайшие годы система станет легче, дешевле и получит более продвинутые функции дополненной реальности. Возможна интеграция с нейроинтерфейсами и технологиями отслеживания взгляда для управления без голоса.

Интересные факты

  • Первый прототип Glass AI был создан в 2011 году в лаборатории Google X (ныне X Development).
  • В 2014 году Google Glass попал в список «50 лучших изобретений года» по версии журнала Time.
  • В 2023 году система Glass AI была использована для помощи людям с ограниченными возможностями: например, слабовидящим пользователям она зачитывает текст и описывает сцены.

BFOmetr — база данных и аналитика по компаниям России.

На главную BFOmetr →