• Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов
AITopGuide
Новости нейросетей и полезная информация об ИИ
Автор

admin

    Генерация изображений

    Luma Labs представила модель Uni-1 которая думает и рисует одновременно

    admin 26.07.2026


    Luma Labs представила Uni-1 — первую генеративную модель, которая объединяет мышление и создание изображений в одном процессе. Система не просто выполняет команды, а анализирует намерение пользователя и формирует визуальный результат «на лету». Разработка уже доступна для тестирования и может изменить подход к генерации контента.

    Содержание

    1. Как устроена новая архитектура
    2. Пространственное мышление и логика
    3. Работа с референсами
    4. Культурная адаптация
    5. Интеграция с документами
    6. Результаты и стоимость

    23 марта компания Luma Labs AI объявила о запуске новой генеративной модели Uni-1. Это первая система, в которой понимание запроса и создание изображения происходят одновременно, без разделения на отдельные этапы. Разработчики уже открыли доступ к тестированию на собственной платформе.

    Главное отличие Uni-1 — архитектура Unified Intelligence. Она позволяет модели не просто реагировать на текстовые команды, а разбираться в намерениях пользователя и корректировать результат прямо в процессе генерации. По сути, система «размышляет» вместе с человеком, что заметно влияет на итоговое качество изображений.

    Как устроена новая архитектура

    В основе Uni-1 лежит автогенеративный трансформер decoder-only — тот же принцип, что используется в больших языковых моделях. Однако здесь текст и визуальные данные объединены в единую последовательность токенов. Это означает, что модель не делит процесс на «понимание» и «рисование», а всё происходит в одном вычислительном проходе.

    В отличие от диффузионных моделей, которые начинают с шума и постепенно его очищают, Uni-1 предсказывает результат шаг за шагом. Она генерирует как слова, так и элементы изображения последовательно, одновременно проверяя логичность сцены, освещение и физику объектов.

    По сути, модель работает как художник, который не просто рисует, а постоянно задаёт себе вопросы: «А правильно ли падает тень?», «Соответствует ли перспектива?» и сразу вносит правки.

    Пространственное мышление и логика

    Одной из ключевых особенностей Uni-1 стало развитое пространственное мышление. Модель умеет достраивать сцены, учитывать взаимное расположение объектов и сохранять физическую правдоподобность.

    Например, при редактировании изображения она корректно пересчитывает освещение, перспективу и взаимодействие элементов. Это особенно важно для сложных композиций, где традиционные модели часто допускают ошибки.

    По данным внутренних тестов, Uni-1 показывает высокие результаты в задачах, требующих логики и последовательного анализа. В частности, она лидирует в бенчмарке RISEBench, ориентированном на визуальное редактирование с учётом рассуждений.

    Работа с референсами

    Модель получила продвинутые инструменты управления через эталонные изображения. Пользователь может загрузить фотографию, эскиз или любой визуальный пример, а Uni-1 сохранит стиль, композицию и ключевые детали при генерации нового контента.

    Это открывает возможности для создания серий изображений в едином стиле, редактирования существующих работ и точного контроля результата без длинных текстовых описаний.

    Культурная адаптация

    Разработчики отдельно подчёркивают способность модели учитывать культурный контекст. Uni-1 понимает стили — от интернет-мемов и манги до классических художественных направлений и адаптирует визуальный язык под задачу. В базе системы более 70 художественных стилей, и при этом она сохраняет смысл изображения, а не просто копирует визуальные элементы.

    Интеграция с документами

    Uni-1 используется внутри платформы Luma Agents, которая поддерживает работу с текстовыми материалами. Пользователи могут загружать PDF-файлы, сценарии, презентации и другие документы.

    поддерживает работу с текстовыми материалами

    Система способна анализировать содержимое, выделять ключевые идеи, создавать краткие пересказы и превращать текст в визуальные или креативные результаты. Это делает модель инструментом не только для дизайнеров, но и для продюсеров, маркетологов и сценаристов.

    текст в визуальные или

    Результаты и стоимость

    По внутренним оценкам Luma Labs, Uni-1 заняла первое место в рейтинге пользовательских предпочтений (Elo) по качеству изображений, стилю и редактированию, а также по работе с референсами. В категории text-to-image модель уступила только одной системе.

    рейтинг пользовательских предпочтений Elo

    Стоимость генерации составляет около 0,09 доллара за изображение в разрешении 2K (примерно 8–9 рублей), что делает её более доступной по сравнению с рядом конкурентов.

    Пользователи, уже протестировавшие модель, отмечают важное изменение: теперь не нужно подробно прописывать длинные промпты. Достаточно описать идею, а остальное система достраивает самостоятельно.



    Источник

    26.07.2026 0 комментариев
    0 VKOdnoklassnikiEmail
  • Генерация видео

    Новая модель Runway Gen-4: реалистичные видео и полный контроль над сюжетом

    admin 26.07.2026
    26.07.2026

    Gen-4 предлагает более высокую реалистичность, согласованность и контроль над визуальным повествованием. Новая технология уже доступна подписчикам и открывает новые горизонты …

    0 VKOdnoklassnikiEmail
  • Новости

    ИИ в бизнесе: Российские предприниматели активно интегрируют новые технологии

    admin 26.07.2026
    26.07.2026

    Исследование, проведенное совместно Сбером и другими организациями, показало, что 45% предпринимателей малого и микробизнеса России уже используют искусственный интеллект в …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Промокоды для Higgsfield AI — как получить и активировать

    admin 26.07.2026
    26.07.2026

    Higgsfield AI стремительно набирает популярность среди креаторов, блогеров и маркетологов. Но несмотря на удобство и качество, у многих пользователей возникает …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    Midjourney V8.1 ускорилась и вернула стиль

    admin 25.07.2026
    25.07.2026

    Midjourney выпустила альфа-версию V8.1, в которой разработчики сделали ставку на баланс: вернули фирменный визуальный стиль, ускорили генерацию и сразу добавили …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Higgsfield AI анонсировала Higgsfield Mix: новый инструмент для создания кинематографических видео

    admin 25.07.2026
    25.07.2026

    Компания Higgsfield AI представила инструмент Higgsfield Mix, позволяющий создавать невозможные с точки зрения физики движения камеры в видео. Новинка открывает …

    0 VKOdnoklassnikiEmail
  • Новости

    Ozon внедряет ИИ для создания видеообложек товаров

    admin 25.07.2026
    25.07.2026

    Маркетплейс Ozon запустил новый сервис на базе ИИ для автоматической генерации видеообложек товаров, предоставляя продавцам дополнительный инструмент для привлечения внимания …

    0 VKOdnoklassnikiEmail
  • Обзор сервисов

    Топ-10 видео, созданных с помощью Higgsfield AI

    admin 25.07.2026
    25.07.2026

    ???? Лучшие примеры видео, созданных с помощью Higgsfield AI Higgsfield AI покорила мир коротких видео своими мощными эффектами и уникальными …

    0 VKOdnoklassnikiEmail
  • Генерация изображений

    ImagineArt показала модель 2.0

    admin 24.07.2026
    24.07.2026

    ImagineArt представила модель ImagineArt 2.0 и делает ставку на то, что в генерации изображений пользователям важен уже не только визуальный …

    0 VKOdnoklassnikiEmail
  • Генерация видео

    Kling 2.0 открывает новую главу в генерации визуального контента

    admin 24.07.2026
    24.07.2026

    Китайская платформа Kling 2.0 от Kuaishou выходит на новый уровень: искусственный интеллект научился создавать видео и изображения с кинематографическим качеством …

    0 VKOdnoklassnikiEmail
Новые
Старые

Свежие записи

  • Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе
  • Gen-3 Alpha от Runway теперь доступна для платных тарифных планов
  • Цифровые паспорта в России — революция или эволюция?
  • Революционная платформа KLING AI для генерации видео теперь доступна каждому
  • Искусственный интеллект получил правила игры в российской медицине

Свежие комментарии

Нет комментариев для просмотра.

Новые статьи

  • Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров — открытые веса выйдут на следующей неделе

    04.08.2026
  • Gen-3 Alpha от Runway теперь доступна для платных тарифных планов

    02.08.2026
  • Цифровые паспорта в России — революция или эволюция?

    02.08.2026
  • Революционная платформа KLING AI для генерации видео теперь доступна каждому

    01.08.2026
  • Искусственный интеллект получил правила игры в российской медицине

    01.08.2026
  • Alibaba выпустила Qwen-Image-3.0 без весов и бенчмарков, но с промптами на 4500 токенов

    31.07.2026

Рубрики

  • Генерация видео (96)
  • Генерация звука (14)
  • Генерация изображений (85)
  • Генерация текста (49)
  • Новости (42)
  • Обзор сервисов (36)

Alibaba представила Qwen 3.8‑Max на 2,4 трлн параметров...

04.08.2026

Gen-3 Alpha от Runway теперь доступна для платных...

02.08.2026

Цифровые паспорта в России — революция или эволюция?

02.08.2026

Революционная платформа KLING AI для генерации видео теперь...

01.08.2026

Искусственный интеллект получил правила игры в российской медицине

01.08.2026

Обзоры

  • Higgsfield AI: Революция в создании видео с искусственным интеллектом

    30.07.2026
  • Как создать видео с эффектом Soul в Higgsfield AI: пошаговое руководство

    29.07.2026
  • Как оплатить Higgsfield AI и какие есть тарифы: подробный гайд

    28.07.2026

Выбор редакции

  • DeepSeek представила обновлённую ИИ-модель VL2

    27.06.2026
  • Новые функции ChatGPT от OpenAI — теперь он может видеть, слышать и говорить

    24.07.2026
  • Как использовать Higgsfield AI для генерации эффектов «zoom out»

    01.07.2026

Популярное

  • 1

    Промты для открытки на 23 февраля: +нейросети для создания открытки

    21.06.2026
  • 2

    Google встроил в Gemini генератор музыки Lyria 3

    21.06.2026
  • 3

    Wan2.2 научилась рисовать: видеомодель от Krea теперь создаёт впечатляющие изображения по запросу

    24.06.2026
  • Pinterest
  • Youtube
  • Email
  • Vk
  • Rss
  • Yandex

@2026- All Right Reserved.


Наверх
AITopGuide
  • Новости
  • Генерация видео
  • Генерация изображений
  • Генерация звука
  • Генерация текста
  • Обзор сервисов