Sand.ai выкатили в опенсорс превью своей унифицированной модели генерации видео + аудио, одной моделью, за один проход • 114B параметров всего, но активируется только 6B на токен благодаря MagiMoE • Совместный дизайн: архитектура + системы обучения + пайплайн данных • Двухстадийная генерация: magi2_preview рисует клип в низком разрешении, magi2_refiner докручивает до 1080p • Заявленный фокус эффективный путь масштабирования видеомоделей 🔘Что умеет txt2vid, img2vid, звук генерируется вместе с видео и вшивается в итоговый файл через ffmpeg, длина клипа 10 сек (пока что), разрешение превью модели 512x896, рефайнер 1088x1920 Внутри текстовый энкодер Qwen3...
Neurogen
ComfyUI-Spectrum-MiniMax-H3
ComfyUI-Spectrum-MiniMax-H3 Ускорялка для нового minimax h3 Новый кастомный нод для ComfyUI, который предсказывает скрытые признаки трансформера MiniMax H3 вместо того, чтобы гонять его на каждом шаге Spectrum обучает модель Чебышёва (ridge regression) на реальных выходах H3-трансформера и прогнозирует эти признаки на будущих шагах Трансформер при этом пропускается но финальный слой, аудио/видео рекон и маппинг сигм всё равно выполняются честно 🔘Сколько экономит? На 20-шаговом ране: - Euler → 35% меньше вызовов трансформера (7 из 20 шагов — прогноз) - RES multistep / CFG++ → 30% меньше...
Qwen 3.8-Max
Новый флагман семейства, автономный исполнитель многодневных инженерных и бизнес-задач И впервые для класса Max веса будут открыты уже на следующей неделе 2.4Т параметров с 95В активных на МоЕ, построен на базе развития Qwen 3.5 Фокус: coding, work, research, long-horizon tasks Рассказывать особо что то про модель не вижу смысла, это конкурентный монстр, лучше перенесу вам кейсы от разрабов, наслаждайтесь 🔘Coding 10+ дней самоэволюционирующего харнесса Модель с нуля построила проект oh-my-cli,...
MiniMax H3
Опен сорс мультимодалка для генерации текста, изображений, видео и аудио в единой бесшовной системе 🔘Видео в 2K со стереозвуком, Модель генерирует ролики длиной до 15 секунд в нативном разрешении 2K, она сразу создает качественный стереозвук (голоса, эффекты и музыку) без костылей 🔘Гениальное понимание контекста, вы можете закинуть в промпт видео, картинку и аудио одновременно, просто написав: «Возьми движение камеры из Видео 1, заставь персонажа из Картинки 2 петь, используя вокал из Аудио 3» H3 сама всё поймет и сведет Генерация в 2K обходится более чем в 3 раза дешевле,...
