ИИ-новости за май: Gemini во всём, Figma с AI, а видео теперь правят одним кадром

5 июн 2026 Новости


Май прошёл под знаком больших ИИ-переездов. Нейросети всё меньше похожи на отдельные сайты, куда нужно идти с отдельной задачей, и всё больше — на слой внутри привычных рабочих инструментов.

В этом выпуске: Google устраивает праздник Gemini на I/O, Figma встраивает AI в canvas, Anthropic обновляет Claude Opus, Runway делает редактирование видео ближе к Photoshop, а инженеры получают первые внятные AI-генераторы для CAD.



Google – зашить Gemini вообще везде


Google провела I/O 2026 и показала примерно всё и сразу: новую Gemini 3.5 Flash, мультимодальную Gemini Omni, агентский поиск, Google Pics, обновления Flow, AI-очки на Android XR и ещё пачку функций, которые превращают Gemini в системную прослойку Google-продуктов. Давайте разбираться.


Источник видео

Что важного

Gemini 3.5 Flash теперь развернули в большинстве инструментов Google: в поиске, Gemini-приложении, Google AI Studio, Android Studio, Antigravity и корпоративных Gemini-платформах. Модель продвигают как быструю и достаточно сильную для агентских задач, кодинга и длинных сценариев, где предполагается итерационный процесс.


Источник видео

Поиск тоже становится более агентским. Google показывает его как интерфейс, который может собирать информацию, следить за обновлениями, строить кастомные выдачи, визуализации и даже мини-приложения под конкретную задачу. Звучит как мечта для тех, кто устал открывать пятнадцать вкладок ради одного ответа. И как лёгкий кошмар для тех, кто эти вкладки монетизировал.


Источник видео

Отдельный большой блок — Gemini Omni. Это новая мультимодальная модель Google для генерации и редактирования видео. На вход можно давать текст, изображения, видео и аудио, а дальше через диалог менять сцену, стиль, фон, персонажей и визуальные детали. Пока всё это, конечно, выглядит как демо из будущего, но направление очевидное: видео постепенно переезжает из монтажной программы в диалоговое окно.


Источник видео

Дизайн-команды может заинтересовать Google Pics. Это отдельный AI-редактор изображений, где можно редактировать объекты, менять элементы и работать с картинками без ручного вырезания, масок и слоёв в привычном смысле. Внутри — Nano Banana с возможностью налету изменять выбранные объекты. Photoshop пока никто не отменял, но Google явно хочет откусить кусок рынка в задачах, где не нужны сложные инструменты.


Источник видео

Почему это важно

Google показал, что ИИ будет во всех точках контакта сервисов и пользователя. Всё движется к рабочей среде, где модель видит контекст, файлы, задачу и может сама предложить следующий шаг. Осталось дождаться момента, когда она начнёт не только красиво обещать, но и стабильно выдавать предсказуемый результат.



Figma встроила AI-агента прямо в рабочий canvas


Figma в мае показала сразу несколько AI-обновлений. Это важное обновление, потому что Figma — это не отдельный сервис для экспериментов, а рабочая среда, где дизайнеры, продакты и разработчики уже проводят большую часть времени.


Источник видео

Главное нововведение — Figma design agent. Это AI-агент, который работает прямо в рабочем пространстве Figma. Агент видит контекст макета и может помогать с реальными задачами внутри файла.

Что умеет

Figma описывает агента как инструмент для исследования идей, правок, работы с дизайн-системами и превращения обратной связи в действия. То есть его задача — убрать часть ручной возни: пересобрать вариант, поправить элементы, разложить экран, применить систему компонентов или ускорить итерации.

Отдельно Figma обновила Make. Теперь он может работать не только с прототипами, но и с локальной базой кода: редактировать код, принимать аннотации и общаться через чат. Пока это ограниченная бета, но направление понятное — Figma хочет быть не только местом, где рисуют интерфейс, а пространством, где идея быстрее доходит до рабочего прототипа и кода.

Почему это важно

Если AI-агент встроен прямо в Figma, он попадает в реальный рабочий процесс. И чем больше автоматизации появляется в инструменте, тем важнее становятся насмотренность, умение ставить задачи, понимание системы и способность отделять рабочие решения от нейрослопа. ИИ помогает собрать черновик, но довести его до достойного финального качества способен только человек.



Claude Opus 4.8 – полезнее в агентских задачах


Anthropic выпустила Claude Opus 4.8. Обновление не выглядит как революция с барабанами и трубачом, зато оно хорошо попадает в текущий тренд: модели лучше работают в длинных задачах, меньше выдумывают и честнее сигнализируют, когда в чём-то не уверены.

Claude Opus 4.8
Источник фото

Что изменилось

Anthropic заявляет улучшения в бенчмарках, кодинге, агентских сценариях и практических рабочих задачах. В Claude появился контроль усилия: можно выбирать, насколько глубоко модель должна думать над ответом. Меньше усилия — быстрее и дешевле по лимитам, больше усилия — медленнее, но с расчётом на более качественный результат.

Для Claude Code добавили Dynamic Workflows — исследовательский режим, где Claude может планировать большую задачу и запускать множество параллельных субагентов в одной сессии. По задумке, это нужно для крупных миграций, больших кодовых баз и сложных процессов.

Ещё один важный акцент — честность. Anthropic пишет, что Opus 4.8 лучше замечает неопределённость и меньше склонен уверенно заявлять о прогрессе там, где доказательств маловато.

Почему это важно

В рабочих сценариях проблема нейросетей давно не только в качестве ответа. Гораздо опаснее, когда модель уверенно ошибается, не показывает сомнения и заставляет человека искать подвох в идеально написанном тексте.

Claude Opus 4.8 старается реже делать вид, что всё понял и проверил, когда на самом деле просто красиво сформулировал.

Мелочь? Совсем нет. Это как раз разница между бесполезным инструментом и инструментом, которому можно постепенно доверять рабочие процессы.



Runway Aleph 2.0 редактирует видео проще


Runway обновила Aleph до версии 2.0 и добавила Edit Studio. Главная идея – вы редактируете один кадр, а модель переносит изменение на остальной ролик, сохраняя то, что трогать не просили.

Runway Aleph 2.0
Источник фото

Что умеет

Aleph 2.0 можно попросить изменить конкретную деталь: цвет продукта, одежду, причёску, фон, сезон, стиль или объект в сцене. Модель должна изменить именно выбранный элемент, не пересобирая всё видео заново и не превращая ролик в соседнюю вселенную.

Самое главное — работа с одним кадром. Пользователь правит нужный кадр, смотрит превью как изображение, уточняет результат, а потом применяет правку к видео. Также Aleph 2.0 поддерживает клипы до 30 секунд в 1080p и может применять правки в роликах с несколькими сценами.

Почему это важно

Самая дорогая часть видеопродакшена часто начинается после слов: «А можно ещё один вариант?». Поменять цвет продукта, заменить фон, адаптировать сезон, сделать другую стилистику, убрать лишний объект.

Aleph 2.0 бьёт ровно в эту боль. Правда, чудес всё ещё ждать не стоит. Чем сложнее движение, отражения, пересечения объектов и свет, тем выше шанс, что модель начнёт «творчески интерпретировать» задачу. Но направление правильное: генеративное видео постепенно превращается из аттракциона в нормальный инструмент постпродакшена.



CAD-агенты: нейросети добрались до инженерных моделей


В мае заметно ожил сегмент text-to-CAD и CAD-агентов. Самый прикладной пример — репозиторий text-to-cad, он же CAD Skills: набор навыков для AI-агентов, которые помогают генерировать, проверять, экспортировать и передавать CAD- и robotics-артефакты.

CAD Skills
Источник фото

Что внутри

CAD Skills рассчитан на работу с локальными проектными файлами и агентскими инструментами вроде Codex и Claude Code. Агент может получать текстовое задание, генерировать CAD-артефакт, проверять геометрию, готовить экспорт и передавать результат дальше.

Поддерживаются инженерные и 3D-форматы: STEP, STL, 3MF, DXF, GLB, а также форматы описания роботов вроде URDF, SRDF и SDF. То есть речь о попытке встроить LLM-агента в нормальный инженерный пайплайн.

Параллельно в исследованиях появляются новые бенчмарки и подходы к text-to-CAD. Например, CADTestBench предлагает проверять результат не только визуально, но и через автоматические тесты геометрических и топологических требований. Это важный момент: в инженерии деталь должна быть валидной, измеримой и пригодной для дальнейшей работы.

Почему это важно

Для промышленного дизайна и инженерии это первые шаги к тому, чтобы агент мог взять на себя черновые, проверочные и конвертационные операции: собрать базовую форму, подготовить варианты, экспортировать нужные форматы, проверить ограничения, сгенерировать вспомогательные файлы.

Пока такие инструменты требуют контроля и понимания CAD-процесса. Но сам факт, что агенты начали получать специализированные CAD-навыки, важнее очередного чат-бота с обещанием «ответить на любые вопросы без цензуры».



Что ещё интересного в мире ИИ



Немного новостей одной строкой. Они не все тянут на отдельный большой блок, но хорошо показывают, куда движется рынок:

NVIDIA на Computex показала RTX Spark — платформу для локальных AI-агентов на ПК и рабочих станциях.

ByteDance выложила Video Upscaler на Replicate: инструмент для повышения качества видео до 4K и 60 FPS с пресетами под AI-ролики, пользовательский контент и реставрацию.

Removerized — локальный инструмент для удаления фона, batch-обработки и апскейла изображений.

Odysseus от PewDiePie неожиданно залетел в ИИ-сообщество: self-hosted AI workspace с фокусом на локальный запуск, приватность и работу без больших облачных платформ.

Open-Generative-AI собирает в одном интерфейсе доступ к множеству генеративных моделей для изображений и видео — это не «бесплатный локальный Higgsfield без ограничений», а скорее удобная оболочка вокруг внешних сервисов и API.

Сбер открыл тестирование GigaCowork — платформы для создания AI-агентов бизнес-пользователями без разработки.

Apple тестирует сторонние AI-модели для новой Siri в iOS 27, включая Gemini. Но пока это не официальный релиз, а индустриальный сериал «Apple всё ещё пытается сделать Siri умной».


Май хорошо показал главный тренд — ИИ переезжает в большие сервисы, а значит совсем скоро искать отдельную вкладку ChatGPT уже не придётся — он просто будет ждать нас внутри привычных инструментов.

На этом всё, увидимся в следующем месяце.


Автор: Гамза Иван

Руководитель IT направления Лаб 20/50

Другие материалы

Читать все