ИИшница №104
Всем привет! Это «ИИШНИЦА», 10 новостей про нейросети, контент и заработок. Сегодня в выпуске: Beeble SwitchX в Syntx AI переносит актёров в любую сцену с сохранением лица, мимики и липсинка. Backrooms выросли из страшилки с 4chan в фильм на 118 млн долларов. Kuba Creates AI собирает миллиарды просмотров на простых вирусных роликах. HAELE 3D решает проблему рук и поз для художников, а TikTok AI-аватары используют эмоции зрителей для продаж.
#1. Switx от Beeble убирает компоузинг из VFX (Эксклюзив!)
Beeble представила Switx — нейросеть для генерации видео, которая упрощает VFX и компоузинг, делая их доступными без профессиональных навыков. Модель интегрирована в Syntx, что позволяет работать без VPN, зарубежных карт или SIM. Switx поддерживает HD и Full HD и предлагает четыре режима генерации: авторежим для простого старта, выделение первого кадра с маской для локальных изменений и дополнительные настройки через контекстный промт.
Нейросеть позволяет комбинировать живое видео с графикой, генерируя до 9 секунд клипа за раз (максимум 240 кадров). В авторежиме достаточно загрузить видео и референс по стилю, а GPT image 2 может помочь с подготовкой кадров. Режим выделения позволяет менять отдельные элементы, например одежду на человеке, через простое выделение кисточкой и последующую генерацию. Стоимость работы сравнительно невысока — например, клип на 5 секунд обходится около 36 токенов (~1 доллар).
Switx ориентирована на создание рекламных и музыкальных роликов с элементами VFX, где важны эмоции живых актёров и стильная графика. Для региональных проектов это может стать бюджетной альтернативой дорогим решениям вроде Seedance, позволяя легко управлять визуальными эффектами прямо в Syntx.
Источник: https://www.instagram.com/p/DYmP5BoT2Gx/
#2. Grok 1.5 наконец-то догнал топов? Не совсем.
Grok Imagine Video 1.5 Preview вышел в превью-версии и уже получил много внимания из-за генерации видео из текста или изображения со звуком прямо в ролике. По словам автора, модель умеет добавлять диалоги, музыку и эффекты без отдельного аудиослоя, быстро рендерит, неплохо следует промпту и уверенно работает с медленными сценами.
Главная сильная сторона Grok Imagine Video 1.5 Preview — оживление портретов: модель передаёт микровыражения, движение глаз и мелкую мимику. Особенно аккуратно, по наблюдению автора, она работает с ретро-фотографиями и старыми снимками. При этом в динамичных сценах результат хуже: резкие движения, драки и экшн могут разваливаться, а по качеству таких сцен модель пока не дотягивает до Kling и Seedance. Как альтернатива топовым видеомоделям Grok Imagine Video 1.5 Preview выглядит спорно, но за счёт цены может быть интересен как вариант по соотношению цена/качество
Источник: https://x.com/elonmusk/status/2062337074368508253?s=20
#3. TwelveLabs делает Ctrl+F для видео
Стартап TwelveLabs из Сан-Франциско представил инструмент для поиска по видео по содержимому кадра, а не по имени файла или тегам. Модель позволяет находить моменты по текстовому запросу, например, «человек берёт нож» или «спортсмен бросает трёхочковый», различая контекст сцены. Система анализирует картинку, звук и речь одновременно, делая поиск максимально точным.
В основе решения две модели: Marengo превращает видео в эмбеддинги и ищет по любому запросу на 47 языках с точностью около 78%, а Pegasus описывает ролик, делает нарезку с таймкодами и извлекает смысл видео длительностью до двух часов. Часовое видео индексируется примерно за минуту, и платформа способна обрабатывать до 10 тысяч часов в сутки, обрабатывая до 4 часов за один запрос. Сервис уже используют NFL и поддерживают Nvidia, Intel и Samsung.
TwelveLabs позволяет быстро находить нужные сцены, создавая функционал вроде Ctrl+F для видео, что особенно полезно для спортивных, обучающих и коммерческих материалов, где важно быстро извлечь ключевые моменты.
Источник: https://www.twelvelabs.io/
#4. ElevenLabs дал доступ к голосу Стэна Ли.
ElevenLabs заключил соглашение со Stan Lee Universe, добавив голос и образ Стэна Ли в библиотеку сервиса. Стэн Ли, создатель Человека-паука и Людей Икс, умер в 2018 году, и теперь его голос можно использовать для личных проектов через ElevenLabs, а озвучка коммерческих материалов пока запрещена. Технологически сервис поддерживает Professional Voice Cloning, но для конкретного клонирования нужны юридические права и минимум полчаса чистого аудио.
Ситуация демонстрирует, как рынок движется к лицензированным голосам знаменитостей, которые можно использовать без новых съёмок и сессий, превращая их в цифровые активы. При этом остаются этические вопросы: аудитория может негативно реагировать на использование образа умершего человека, даже если юридически это разрешено. ElevenLabs открывает путь для будущих практик медиа, где голоса и образы будут лицензируемыми и управляемыми через нейросети.
Источник: https://x.com/interesting_aIl/status/2059717216816238617?s=20
#5. Reve 2.0 обошёл Nano Banana 2 на Arena
Reve выпустила модель Reve 2.0 для генерации изображений в 4K. Главное отличие — работа не одной цельной картинкой, а через структуру объектов: модель сначала размечает сцену на отдельные контейнеры, расставляет их и только потом дорисовывает детали. Это похоже на слои в Photoshop, но создаются они автоматически внутри нейросети.
Такой подход позволяет точечно менять элементы изображения: подвинуть логотип, заменить текст или переставить предмет, не ломая всю композицию. По заявлению автора, Reve 2.0 занимает второе место на Arena и находится выше Nano Banana 2 и GPT-Image-1.5. Пока остаётся вопрос, дадут ли пользователям прямой доступ к слоям или контроль останется внутри интерфейса.
Источник: https://x.com/reve/status/2062260665121919101?s=20
#6. Higgsfield упакует любую недвижимость
Higgsfield можно подключить к Claude через MCP и управлять генерацией маркетинговых материалов прямо из чата. Такая связка позволяет превратить объявление о недвижимости в комплект для продвижения: обложки, визуалы, видео-тур, UGC-ролики, структуру лендинга и тексты под конкретную аудиторию. Для площадок вроде Airbnb, Booking, Zillow и Expedia заявлены готовые интеграции и скиллы [verify], поэтому достаточно передать ссылку на объект.
С российскими площадками вроде Avito, Циан и Домклик процесс более ручной: Avito не даёт Claude прямой доступ к данным, поэтому описание и скриншоты нужно загружать в диалог самостоятельно. После этого Claude анализирует объект, формулирует позиционирование, целевую аудиторию и рекламные смыслы, а Higgsfield генерирует визуальные материалы и ролики. Стиль можно адаптировать под аренду или продажу, город, формат подачи и особенности рынка: ипотеку, ЖК, ремонт, вид из окна, расстояние до метро или статус «собственник, без обременений».
Источник: https://x.com/higgsfield/status/2061520692756332677?s=20
#7. Пост с 4chan собрал 118 миллионов в кино
Backrooms прошли путь от поста на 4chan до большого кино. В 2019 году на форуме появилось зернистое фото пустой комнаты с жёлтыми стенами, гудящими лампами и влажным ковром, а подпись описывала бесконечный лабиринт одинаковых помещений. Так возник интернет-миф, который позже превратился в один из самых узнаваемых хоррор-сеттингов.
В 2022 году Кейн Парсонс снял по этой легенде девятиминутную короткометражку, самостоятельно освоив Blender и VFX. По словам автора, серия роликов набрала почти 200 миллионов просмотров, после чего A24 передала ему экранизацию. Для фильма в Ванкувере построили лабиринт площадью около 30 тысяч квадратных футов и подбирали оттенки жёлтого, чтобы воссоздать атмосферу оригинального изображения.
Сообщается, что фильм собрал около 118 миллионов долларов в мире и 81 миллион в США за стартовый уикенд, став лучшим запуском в истории A24 и обойдя свежий Star Wars. Парсонсу 20 лет, и, по данным автора, он стал самым молодым режиссёром, чей фильм занял первое место в прокате
Источник: https://x.com/Cinematografiaz/status/2061480055604412846?s=20
#8. ИИ-продавцы давят на жалость. И это работает
В TikTok набирает обороты тренд с AI-аватарами, которые выдают себя за владельцев малого бизнеса и продают товары через эмоциональные ролики. Такие персонажи плачут в кадре, рассказывают про буллинг, отсутствие поддержки или трудности с запуском дела, а затем просят купить товар, чтобы «спасти маленький бизнес». По данным The Verge, таких аккаунтов уже десятки.
Схема часто строится вокруг образа уязвимого героя: девушки-мастерицы, парня, которого травят за вязание, или человека с драматичной личной историей. Часть товаров, по словам автора, находят на Shein: например, пряжки примерно за 9 долларов перепродают в таких магазинах около 40 долларов. Ролики могут вести в Shopify-магазины, а ответы на комментарии оформляются отдельными видео.
Главная проблема не в AI-аватарах как инструменте, а в симуляции боли, бедности и травли ради продаж. Даже если на ролике есть пометка о генерации, зрители не всегда её замечают. Признаки всё ещё видны: механический голос, странная мимика, скачки света и короткие сцены, но генерации уже достаточно правдоподобны, чтобы эмоциональная реакция срабатывала быстрее проверки.
Источник: https://vc.ru/ai/2957004-neyropredprinimateli-v-tiktok-obman-i-prodazha-tovarov-s-shein
#9. Эти руки в нейросети всегда кривые? HAELE 3D
HAELE 3D — линейка интерактивных 3D-референсов для художников, иллюстраторов и тех, кто работает с персонажами. Это не генератор изображений, а студия, где можно в реальном времени крутить модель руки, ноги, лица или тела, менять позу, ракурс, свет и сразу видеть тени, пропорции и анатомические ошибки.
В линейке есть Hand Poses Pro для готовых и настраиваемых поз рук, Portrait Studio Lite для лиц и мимики, а также Pose Studio Max с расширенной анатомией, жестами и кастомными позами. Пользователь может менять пропорции модели, настраивать сцену, сохранять её и использовать VR-поддержку. По словам автора, проект в одиночку сделал разработчик Айге Олвен: интерфейс, модели, свет, камера и демо-версии на Steam.
HAELE 3D закрывает одну из самых частых проблем визуальных авторов — поиск точных референсов для сложных поз, особенно рук. Вместо случайных картинок или ошибок генерации художник получает управляемую 3D-сцену, которую можно подстроить под конкретный кадр.
Источник: https://x.com/haele3d/status/2061034885993669006?s=20
#10. Kuba набрал миллиарды просмотров на AI-видео
Kuba Creates AI — кейс AI-креатора, который строит вирусные ролики на одном повторяемом приёме: берёт узнаваемого персонажа, мем или знаменитость и оживляет их в новой ситуации. В таких видео важна не сложная режиссура, а сам момент оживления: зрителю интересно увидеть, как знакомый образ начнёт двигаться, говорить и вести себя в неожиданном контексте.
По словам автора, у Kuba Creates AI больше миллиона подписчиков в TikTok, десятки миллионов лайков, сотни миллионов просмотров на YouTube и заявленные миллиарды просмотров суммарно. После роста аудитории он запустил Kuba Creators — обучение и платформу для создания AI-персонажей и масштабирования формата по каналам.
Главная механика здесь — участие аудитории. Подпись «кого сделать следующим?» превращает комментарии в поток идей: зрители сами предлагают новых героев, а автор повторяет рабочий формат. Получается контент-машина, где один приём, узнаваемые персонажи и постоянная обратная связь дают стабильную вирусность.
Источник: https://www.tiktok.com/@kuba.creates.ai
Смотреть на YouTube: https://youtu.be/Zp2gSXkyvcA?si=Im3tWQ-_RlegkyJt
Смотреть на Rutube: https://rutube.ru/video/daf7af21c03d3ff963301ff74d1cb92d/
* * *
Если вы AI-креатор и хотите быть в курсе самых актуальных новостей про нейросети, AI-видео и цифровых аватаров, подписывайтесь на мой Telegram-канал «Гари ИИ-Аватар».
Там — больше новостей, разборов инструментов и моего практического опыта: https://t.me/gari_azat
Если вы уже работаете с нейросетями, создаёте AI-контент и видео для себя или клиентов и хотите получать больше заказов, выстроить системную работу, научиться делегировать и со временем создать собственный видеопродакшн, приходите на мой авторский курс:
https://aiavatar.school
Это про мышление креатора в AI-видеоиндустрии: от хаотичных заказов к понятной модели роста и работе с командой.
В нашем видеопродакшене мы используем сервис Syntx AI для создания нейросетевых видео в коммерческих проектах.
По моей ссылке вы можете получить подарочные токены и скидку 15% на подписку по промокоду GARI:
https://syntx.ai/welcome/jbgz60nM
