Google DeepMind рассказала о внедрении ИИ для жестовых языков в пользовательские продукты. Разбираем, почему это важно для доступности и где технология пока не заменяет переводчика.
Google DeepMind развивает Lyria 2 для инструментальной музыки. Разбираем обновление глазами монтажёра: тайминг, SynthID, права, ограничения и честный тест на своём ролике.
Octave от Hume AI — «речевая языковая модель»: она понимает смысл фразы и подбирает интонацию и эмоцию под контекст, а голос можно задать описанием словами. Из РФ нужен VPN.
Генератор картинок Reve делает ставку на точное следование сложному промту и аккуратный текст на изображении, а ещё умеет менять детали готовой картинки по словам. Из РФ нужен VPN.
Разбираем Veo 4 по рабочим сценариям: движение, звук, режиссёрские подсказки, доступность, права и тест, который показывает реальные ограничения модели.
Новое поколение компактных моделей Microsoft: маленькая модель показывает качество крупнее себя, запускается локально на ноутбуке и открыта под лицензией MIT.
Главный конкурент Suno обновил генератор музыки: ставка на аудиокачество и детализацию, продление трека и перегенерация отдельных частей. Доступ по подписке, из РФ нужен VPN.
Генератор 3D-моделей по картинке и тексту обновился: чище геометрия, больше детализации и экспорт в популярные форматы. Готовые заготовки для игр, визуализации и печати — но с доработкой руками.
Генератор картинок, знаменитый аккуратным текстом на изображении, обновился: заметно вырос фотореализм, появился подбор стиля по референсу, а надписи и постеры стали ещё точнее.
Китайская MiniMax обновила видеогенератор Hailuo: реалистичное движение и физика сцены, точное следование промту и режим оживления фото. Веса закрытые, доступ через сервис и API.
Tencent обновила открытую модель Hunyuan: эффективная MoE-архитектура, большое окно контекста, сильный китайский и английский. Веса открыты, в России работает без VPN.
Разбираем Command A Reasoning от Cohere: где помогает дополнительный вычислительный бюджет, как проверять RAG и какие ограничения важны для корпоративного пилота.
Recraft обновил генератор изображений: V4 делает упор на дизайн — логотипы, бренд-графику, единый стиль в серии и вывод в вектор (SVG), а не только в растр.
Zhipu AI обновила открытую линейку GLM: подтянуты кодинг и агентные задачи, работа без VPN в России сохранилась. Ещё один сильный открытый конкурент DeepSeek и Qwen.
Suno представила шестое поколение генератора музыки: чище звук, естественнее вокал и связнее структура трека. Работает и с русским языком. Разбираем, что изменилось.
Midjourney представила восьмое поколение генератора картинок: реалистичнее, точнее к запросу и стабильнее по стилю между кадрами одной серии. Разбираем, что изменилось.
Kuaishou представила Kling 4 — новое поколение видеомодели: ролики стали длиннее, движение стабильнее, а «оживление» фотографий заметно лучше. Разбираем, что изменилось.
DeepSeek обновила V4 до версии 4.1. Разбираем заявленные улучшения кода и рассуждений, совместимость, локальный запуск и честный тест на своих задачах.
xAI представила Grok 5 — новый флагман с упором на рассуждения и доступом к событиям в реальном времени через соцсеть X. Разбираем, что нового и в чём подвох.
Runway представила видеогенератор Gen-5: длиннее ролики, устойчивее персонажи и лучше связь с текстом промпта. Разбираем, что нового и кому это интересно.
Спустя год после первой открытой модели OpenAI выпустила gpt-oss-2 со свободными весами: две версии под разное железо, лицензия Apache 2.0 и заметно подтянутые рассуждения. Разбираем, что это значит для локального ИИ.
594 ГБ весов легли в открытый доступ — теперь модель можно скачать и запустить у себя. Но «открытая» здесь не значит «делай что хочешь»: у лицензии есть оговорки для крупных сервисов. Разбираем, что реально доступно.
AI-редакцияЧитать →
ИИ
Спросить ИИшку
Привет! Я помогу разобраться с нейросетями. Спросите что угодно про ИИ.