Раздел
Статьи Дзен
Muse Glimmer: локальная агентная модель для сложных задач
Muse Glimmer: локальная агентная модель для сложных задач
MiniMax H3 Team ответили на вопросы пользователей Reddit
MiniMax H3 Team ответили на вопросы пользователей Reddit
В Arena тестируют анонимную модель mona-lisa-1: возможный преемник GPT Image 2?
В Arena тестируют анонимную модель mona-lisa-1: возможный преемник GPT Image 2?
Qwen-MM-Plugins: мультимодальные возможности для агентских моделей без лишних сложностей
Qwen-MM-Plugins: мультимодальные возможности для агентских моделей без лишних сложностей
Video-DeepResearch: агент, который действительно смотрит видео
Video-DeepResearch: агент, который действительно смотрит видео
Агентная модель UniVR для генерации изображений: что нового
Агентная модель UniVR для генерации изображений: что нового
WorldClaw: агентный подход к генерации 3D-сцен по тексту
WorldClaw: агентный подход к генерации 3D-сцен по тексту
Три инструмента от Дани Шишкова: как Phygital+ меняет работу с нейросетями
Три инструмента от Дани Шишкова: как Phygital+ меняет работу с нейросетями
OpenAI приостановила работу над Astra из-за киберрисков после инцидента с Hugging Face
OpenAI приостановила работу над Astra из-за киберрисков после инцидента с Hugging Face
Гугл нервничает
Гугл нервничает
MAGI-2: превью новой open-source модели для генерации видео со звуком
MAGI-2: превью новой open-source модели для генерации видео со звуком
ComfyUI-Latent-Tiled-PiD: новый декодер для генерации изображений
ComfyUI-Latent-Tiled-PiD: новый декодер для генерации изображений
🔼 от мастер-плана до скамейки
🔼 от мастер-плана до скамейки
SplatEdit.app: локальный пайплайн для создания сплатов на WebGPU
SplatEdit.app: локальный пайплайн для создания сплатов на WebGPU
NVIDIA тестирует расширение видеопамяти за счёт SSD: что это значит для пользователей
NVIDIA тестирует расширение видеопамяти за счёт SSD: что это значит для пользователей
InfiniSplat: реконструкция 3D-сцен по одному кадру и глубине
InfiniSplat: реконструкция 3D-сцен по одному кадру и глубине
Comfyui-Minimax-H3-Promptor: автоматизация промптов для видеогенерации
Comfyui-Minimax-H3-Promptor: автоматизация промптов для видеогенерации
ComfyUI-ScenemaAudio: голосовые возможности без обучения
ComfyUI-ScenemaAudio: голосовые возможности без обучения
Wan 3.0: публичная бета, видео за 30 секунд и поддержка документов
Wan 3.0: публичная бета, видео за 30 секунд и поддержка документов
DiffGI: 3D-одежда из одной картинки за секунды
DiffGI: 3D-одежда из одной картинки за секунды
Тенсент идёт к буйволу
Тенсент идёт к буйволу
JoyAI-Video-Edit: потоковое редактирование видео на базе диффузионной модели
JoyAI-Video-Edit: потоковое редактирование видео на базе диффузионной модели
Опубликован код 4D‑реконструктора динамичных объектов из монокулярного видео Lift4D
Опубликован код 4D‑реконструктора динамичных объектов из монокулярного видео Lift4D
ByteDance представила SeedRealtime — ассистент, который не ждёт паузы
ByteDance представила SeedRealtime — ассистент, который не ждёт паузы
UEmbed: мультимодальные эмбеддинги от Alibaba для поиска по тексту, изображениям и видео
UEmbed: мультимодальные эмбеддинги от Alibaba для поиска по тексту, изображениям и видео
Антропик чипируется.
Антропик чипируется.
ComfyUI Video Tiler: экономия памяти при работе с видео и изображениями
ComfyUI Video Tiler: экономия памяти при работе с видео и изображениями
BFL открыли доступ к FLUX 3 по API и в плейграунде
BFL открыли доступ к FLUX 3 по API и в плейграунде
LFM2.5-2.6B: компактная агентная модель для смартфонов
LFM2.5-2.6B: компактная агентная модель для смартфонов
QuerySplat: 3D-сцены по фото без позиций камер и размытости
QuerySplat: 3D-сцены по фото без позиций камер и размытости
Nemotron VoiceChat: новая открытая модель для живого голосового диалога
Nemotron VoiceChat: новая открытая модель для живого голосового диалога
ComfyUI Spectrum MiniMax H3: ускорение генерации для MiniMax H3
ComfyUI Spectrum MiniMax H3: ускорение генерации для MiniMax H3
SANA-Video 2.0: детали новой архитектуры видеогенерации от NVIDIA
SANA-Video 2.0: детали новой архитектуры видеогенерации от NVIDIA
Новый бенчмарк от Андрея Карпаты
Новый бенчмарк от Андрея Карпаты
Qwythos-27B-v1: агентная мультимодальная модель без компромиссов
Qwythos-27B-v1: агентная мультимодальная модель без компромиссов
Суд в Москве отказал в авторских правах на ИИ-арт: «Мона Лиза с вином» осталась без защиты
Суд в Москве отказал в авторских правах на ИИ-арт: «Мона Лиза с вином» осталась без защиты
PrunaVAED: альтернатива для ускорения и экономии VRAM в LTX-2.3
PrunaVAED: альтернатива для ускорения и экономии VRAM в LTX-2.3
MiniMax H3 релизнули
MiniMax H3 релизнули
Qwen3.8-Max: мультимодальная MoE-модель для сложных задач
Qwen3.8-Max: мультимодальная MoE-модель для сложных задач
Sol-Attn: ускорение видеогенерации без обучения от NVIDIA
Sol-Attn: ускорение видеогенерации без обучения от NVIDIA
VideoCoCo: генератор видео с физически корректной анимацией
VideoCoCo: генератор видео с физически корректной анимацией
Disney показал инструмент для интерактивного редактирования анимации движения
Disney показал инструмент для интерактивного редактирования анимации движения
SenseNova U1.5 Lite: превью облегчённой версии для генерации и редактирования изображений
SenseNova U1.5 Lite: превью облегчённой версии для генерации и редактирования изображений
ModelResolver: автоматический поиск и загрузка недостающих моделей для ComfyUI
ModelResolver: автоматический поиск и загрузка недостающих моделей для ComfyUI
LATO.2: генерация 3D-мешей с раздельным контролем геометрии и топологии
LATO.2: генерация 3D-мешей с раздельным контролем геометрии и топологии
FastGen-PDD: ускорение генерации изображений и видео без потери качества
FastGen-PDD: ускорение генерации изображений и видео без потери качества
Minimax H3: генератор видео, который умеет больше, чем кажется
Minimax H3: генератор видео, который умеет больше, чем кажется
CameraAnything: генерация видео с новым ракурсом на базе Wan2.1
CameraAnything: генерация видео с новым ракурсом на базе Wan2.1
MODUS: универсальная мультимодальная модель на базе BAGEL-7B
MODUS: универсальная мультимодальная модель на базе BAGEL-7B
В ОАЭ запускают первый в мире судебный искусственный интеллект
В ОАЭ запускают первый в мире судебный искусственный интеллект
Ваши фото в Instagram могли использовать для AI-генерации без уведомления
Ваши фото в Instagram могли использовать для AI-генерации без уведомления
MicroZoom: апскейл до гигапикселей без потери текстуры
MicroZoom: апскейл до гигапикселей без потери текстуры
MagicMakeup Transfer: перенос макияжа с референса без потери индивидуальности
MagicMakeup Transfer: перенос макияжа с референса без потери индивидуальности
SHELLS: Facebuilder от Гугла — что это и чем отличается от FaceBuilder KeenTools
SHELLS: Facebuilder от Гугла — что это и чем отличается от FaceBuilder KeenTools
OpenPose Studio for ComfyUI
OpenPose Studio for ComfyUI
Moonshot AI раскрыли детали Kimi-K3: 2,8 триллиона параметров и мультимодальность
Moonshot AI раскрыли детали Kimi-K3: 2,8 триллиона параметров и мультимодальность
ComfyUI StreetView-Loader: панорамы Google Street View прямо в пайплайн
ComfyUI StreetView-Loader: панорамы Google Street View прямо в пайплайн
Обязательная маркировка ИИ-контента: что изменится для крупных платформ
Обязательная маркировка ИИ-контента: что изменится для крупных платформ
UniD: модель для плотной разметки видео за один проход
UniD: модель для плотной разметки видео за один проход
Комфиорг выложил готовые к использованию веса Mage-Flow
Комфиорг выложил готовые к использованию веса Mage-Flow
NVIDIA показала инструмент для проверки ИИ-видео на SIGGRAPH
NVIDIA показала инструмент для проверки ИИ-видео на SIGGRAPH
AnyTop: анимация для любых скелетов в 3D
AnyTop: анимация для любых скелетов в 3D
В России запустили сервис для поиска вакансий с помощью искусственного интеллекта
В России запустили сервис для поиска вакансий с помощью искусственного интеллекта
ComfyUI-NKD-VFX-Tools: набор нод для реальных VFX-задач
ComfyUI-NKD-VFX-Tools: набор нод для реальных VFX-задач
Вышел в опенсорс реконструктор сцен на гауссианах F⁴Splat
Вышел в опенсорс реконструктор сцен на гауссианах F⁴Splat
img2threejs: генератор 3D-сцен из изображений прямо в браузере
img2threejs: генератор 3D-сцен из изображений прямо в браузере
FLUX 3: генерация видео и изображений с пониманием сцены
FLUX 3: генерация видео и изображений с пониманием сцены
Реддитор собрал полноценную игру с помощью нейросетей за три недели — без опыта в геймдеве
Реддитор собрал полноценную игру с помощью нейросетей за три недели — без опыта в геймдеве
ИИ теперь понимает ваши каракули
ИИ теперь понимает ваши каракули
LTX-2.3 Clean Plate IC-LoRA: удаление объектов из кадра без следов
LTX-2.3 Clean Plate IC-LoRA: удаление объектов из кадра без следов
Hyra: система от Tencent для автоматизации исследований и инженерных задач
Hyra: система от Tencent для автоматизации исследований и инженерных задач
Solar Open 2: корейская модель для работы с большими задачами
Solar Open 2: корейская модель для работы с большими задачами
GLM-5.2-Vision-NVFP4: новая версия с визуальным энкодером MoonViT
GLM-5.2-Vision-NVFP4: новая версия с визуальным энкодером MoonViT
4-шаговые модели Cosmos 3 Super от Nvidia генерируют видео и картинки в 25 раз быстрее базовой модели
4-шаговые модели Cosmos 3 Super от Nvidia генерируют видео и картинки в 25 раз быстрее базовой модели
FLUX 3: не просто генератор картинок, а заявка на мультимодальность
FLUX 3: не просто генератор картинок, а заявка на мультимодальность
FedorAiToolkit: обучение LoRA с учётом формы тела
FedorAiToolkit: обучение LoRA с учётом формы тела
TimeLens2: поиск моментов в видео по тексту
TimeLens2: поиск моментов в видео по тексту
IGGT4D: онлайн-модель 4D-сцен для видео
IGGT4D: онлайн-модель 4D-сцен для видео
Mage-Flow: компактная модель для работы с изображениями от Microsoft
Mage-Flow: компактная модель для работы с изображениями от Microsoft
LTX-2.3 Clean Plate IC-LoRA: удаление людей и объектов с видео
LTX-2.3 Clean Plate IC-LoRA: удаление людей и объектов с видео
SHELLS: 3D-реконструкция головы без артефактов и с готовой топологией для анимации
SHELLS: 3D-реконструкция головы без артефактов и с готовой топологией для анимации
Qwen‑Image 3.0: генератор и редактор изображений с длинными промптами и точной детализацией
Qwen‑Image 3.0: генератор и редактор изображений с длинными промптами и точной детализацией
WAN 2.2 I2V: Один эксперт и FP4 на RTX 5090 — что изменилось
WAN 2.2 I2V: Один эксперт и FP4 на RTX 5090 — что изменилось
Lucida: открытая модель для удаления фона от MIT
Lucida: открытая модель для удаления фона от MIT
Cosmos 3 Edge: новая модель NVIDIA для локального ИИ
Cosmos 3 Edge: новая модель NVIDIA для локального ИИ
LTX-2.3-3DREAL-LoRA v2: обновление для ИИ-рендера по вьюпорту и примитивам
LTX-2.3-3DREAL-LoRA v2: обновление для ИИ-рендера по вьюпорту и примитивам
HTML‑презентации по запросу: что теперь умеют Claude Code и Codex
HTML‑презентации по запросу: что теперь умеют Claude Code и Codex
PiD v1.5: обновление декодера для генераторов изображений Nvidia
PiD v1.5: обновление декодера для генераторов изображений Nvidia
Frozen v2: часть Gemini прямо в кремнии
Frozen v2: часть Gemini прямо в кремнии
Wan-Streamer v0.3: что нового в интерактивном аудио-видео-генераторе
Wan-Streamer v0.3: что нового в интерактивном аудио-видео-генераторе
MobileWan: генерация видео на смартфоне с рекордной скоростью
MobileWan: генерация видео на смартфоне с рекордной скоростью
MetaView: новые ракурсы из одного снимка с DepthAnything 3 и Qwen-Image-Edit
MetaView: новые ракурсы из одного снимка с DepthAnything 3 и Qwen-Image-Edit
CO2Jump: новый подход к совместной генерации текста и изображений
CO2Jump: новый подход к совместной генерации текста и изображений
Опубликован код визуального ризонера от ByteDance UniVR
Опубликован код визуального ризонера от ByteDance UniVR
Сбой в работе ChatGPT: пользователи по всему миру не могут получить доступ к чатам
Сбой в работе ChatGPT: пользователи по всему миру не могут получить доступ к чатам
SenseNova U1 Pro: генерация изображений и инфографики по-китайски
SenseNova U1 Pro: генерация изображений и инфографики по-китайски
Alibaba представил Qwen3.8 — конкурента Kimi K3 с открытым доступом к весам
Alibaba представил Qwen3.8 — конкурента Kimi K3 с открытым доступом к весам
Две новости в утро воскресенья, 2026-й год: автономная атака на Huggingface и возможный регулятор ИИ в США
Две новости в утро воскресенья, 2026-й год: автономная атака на Huggingface и возможный регулятор ИИ в США
В России представили волну мультфильмов на базе нейросетей
В России представили волну мультфильмов на базе нейросетей
ComfyUI_StarNodes: теперь с сохранением и сравнением панорам
ComfyUI_StarNodes: теперь с сохранением и сравнением панорам
T-Search: как ускорить корпоративный ИИ без расширения GPU-кластера
T-Search: как ускорить корпоративный ИИ без расширения GPU-кластера
Netflix превращает ИИ-шашечки в ИИ-ехать
Netflix превращает ИИ-шашечки в ИИ-ехать
Kimi K5: китайская нейросеть с триллионами параметров и миллионным контекстом
Kimi K5: китайская нейросеть с триллионами параметров и миллионным контекстом
Lucy 2.5 — реалтаймовый композ и редактирование видео
Lucy 2.5 — реалтаймовый композ и редактирование видео
✨ агенты уже здесь
✨ агенты уже здесь
Glob3R: новая система для 3D-реконструкции сцен по фотографиям
Glob3R: новая система для 3D-реконструкции сцен по фотографиям
Яндекс подтвердил безопасность всех генеративных моделей семейства Alice AI
Яндекс подтвердил безопасность всех генеративных моделей семейства Alice AI
ARDY: интерактивная генерация движений человека от NVIDIA
ARDY: интерактивная генерация движений человека от NVIDIA
Как меняется характер Claude в зависимости от языка и версии модели: исследование Anthropic
Как меняется характер Claude в зависимости от языка и версии модели: исследование Anthropic
Новые утечки про Seedance 2.5
Новые утечки про Seedance 2.5
Яндекс объединяет генерацию и редактирование изображений в одной модели
Яндекс объединяет генерацию и редактирование изображений в одной модели
Google представила GNM Head — open-source 3D-модель головы человека
Google представила GNM Head — open-source 3D-модель головы человека
SuperSplat обновился
SuperSplat обновился
StudioRecon: реконструкция 4D-сцен с людьми по минимуму камер
StudioRecon: реконструкция 4D-сцен с людьми по минимуму камер
Reve запускает API для работы с изображениями
Reve запускает API для работы с изображениями