Компания Google презентовала новый проект под названием Project Genie, в основе которого лежит модель Genie 3. Этот экспериментальный прототип дает возможность пользователям создавать интерактивные 3D-мира, основываясь на их текстовых описаниях или изображениях. Доступ к проекту получили подписчики Google AI Ultra из США в возрасте старше 18 лет, ставка на подписку составляет $250 в месяц. В Google DeepMind рассматривают данную модель как важный шаг к достижению искусственного общего интеллекта (AGI), так как она позволяет обучать ИИ-агентов в неограниченных симуляциях.
Project Genie функционирует как веб-приложение, предлагающее три режима. В режиме «создания мира» пользователи могут задавать сцену через текст или загружать изображения, выбирая персонажа и перспективу. Интеграция с Nano Banana Pro дает возможность предварительного просмотра и настройки мира. В режиме исследования Genie 3 генерирует окружение в реальном времени, сохраняя скорость 24 кадра в секунду при разрешении 720p. Третий режим, ремиксы, позволяет изменять готовые миры из галереи.
С технической точки зрения, Genie 3 моделирует физику среды и предсказывает последствия действий пользователя. Ключевым достижением этой модели является сохранение визуальной памяти сцены на протяжении нескольких минут, в отличие от предшественника Genie 2, где время демонстрации часто ограничивалось 10–20 секундами. Однако Project Genie сталкивается с проблемами: не всегда адекватно реагирует на промпты, визульная физика иногда демонстрирует несоответствия, а максимальная продолжительность сессии ограничена 60 секундами. Также не реализована функция динамических событий, намеченная к запуску в августе 2025 года.