Meta представила Muse Image и превью Muse Video
Meta показала модель генерации изображений Muse Image и раннее превью видеомодели Muse Video. Muse Image уже доступна в приложении Meta AI, на meta.ai, в Instagram Stories (США) и в ряде стран в WhatsApp.
Meta Superintelligence Labs представила модель генерации изображений Muse Image и показала раннее превью видеомодели Muse Video в публикации в блоге Meta AI. Muse Image уже доступна пользователям в приложении Meta AI, на сайте meta.ai, в Instagram Stories для пользователей из США и в WhatsApp в ограниченном числе стран.
По описанию в блоге, Muse Image точнее выполняет текстовые запросы, умеет редактировать существующие изображения и собирать сцену на основе нескольких ссылочных картинок. При генерации модель учитывает социальный контекст Instagram — например, форматы и параметры контента в сервисе — чтобы улучшить соответствие результатов пользовательским ожиданиям.
Разработчики характеризуют Muse Image как агентную модель. В процессе создания изображения система способна выполнять веб‑поиск, обращаться к инструментам для написания и выполнения кода и по ходу дорабатывать картинку, меняя элементы сцены в ответ на новые данные или дополнительные инструкции.
Muse Image интегрирована с системой Muse Spark, которая сочетает генерацию медиа и код. В связке эти инструменты могут создавать анимированные GIF, простые веб‑страницы с встроенными изображениями и интерактивные визуальные игры, где генерация контента сопровождается генерацией программной логики.
Раннее превью Muse Video построено на той же базе предобучения, что и Muse Image. По данным компании, превью демонстрирует высокое визуальное качество и нативную поддержку аудио. Meta отмечает продолжающуюся работу над синхронизацией звука и изображения и над корректной передачей быстрого движения перед более широким выпуском видеомодели.
Изображения, созданные в приложении Meta AI с помощью Muse Image, получают невидимый водяной знак Content Seal. В публикации утверждается, что метка сохраняется после кадрирования, сжатия, изменения размера и при создании скриншотов. Компания планирует применить аналогичный механизм и к видео в будущем.
Внутренние метрики Arena, приведённые Meta, показывают, что Muse Image занимает второе место в категориях text‑to‑image, single‑image editing и multi‑image editing, уступая GPT Image 2. Эти данные используются компанией для сравнения результатов модели в наборе тестов.
В качестве дополнительного контекста Meta напомнила о другой недавней разработке: в июне компания представила систему, которая по записям активности мозга без хирургического вмешательства восстанавливает набираемый текст. По заявлению компании, средняя точность распознавания слов в этой системе составила 61%.
Материалы на GNcrypto предоставляются исключительно в информационных целях и не являются финансовой рекомендацией. Мы стремимся публиковать точные и актуальные данные, однако не можем гарантировать их абсолютную достоверность, полноту или надёжность. GNcrypto не несёт ответственности за возможные ошибки, упущения или финансовые потери, возникшие вследствие использования данной информации. Все действия вы совершаете на свой страх и риск. Всегда проводите собственный анализ и консультируйтесь с профессионалами. Подробнее см. в наших страницах Условия, Политика конфиденциальности и Отказ от ответственности.








