Найти в Дзене
Покупайте СтеллыИ дарите их за контент
6 часов назад
 • Вы подписаны

MAGI-2 Preview

Sand.ai выкатили в опенсорс превью своей унифицированной модели генерации видео + аудио, одной моделью, за один проход • 114B параметров всего, но активируется только 6B на токен благодаря MagiMoE • Совместный дизайн: архитектура + системы обучения + пайплайн данных • Двухстадийная генерация: magi2_preview рисует клип в низком разрешении, magi2_refiner докручивает до 1080p • Заявленный фокус эффективный путь масштабирования видеомоделей 🔘Что умеет txt2vid, img2vid, звук генерируется вместе с видео и вшивается в итоговый файл через ffmpeg, длина клипа 10 сек (пока что), разрешение превью модели 512x896, рефайнер 1088x1920 Внутри текстовый энкодер Qwen3...

1 день назад
 • Вы подписаны

Из новостей на сегодня: мне стукнуло 31

☺️ Ну, по Иркутскому времени 🏖

3 дня назад
 • Вы подписаны

ComfyUI-Spectrum-MiniMax-H3

ComfyUI-Spectrum-MiniMax-H3 Ускорялка для нового minimax h3 Новый кастомный нод для ComfyUI, который предсказывает скрытые признаки трансформера MiniMax H3 вместо того, чтобы гонять его на каждом шаге Spectrum обучает модель Чебышёва (ridge regression) на реальных выходах H3-трансформера и прогнозирует эти признаки на будущих шагах Трансформер при этом пропускается но финальный слой, аудио/видео рекон и маппинг сигм всё равно выполняются честно 🔘Сколько экономит? На 20-шаговом ране: - Euler → 35% меньше вызовов трансформера (7 из 20 шагов — прогноз) - RES multistep / CFG++ → 30% меньше...

4 дня назад
 • Вы подписаны

Qwen 3.8-Max

Новый флагман семейства, автономный исполнитель многодневных инженерных и бизнес-задач И впервые для класса Max веса будут открыты уже на следующей неделе 2.4Т параметров с 95В активных на МоЕ, построен на базе развития Qwen 3.5 Фокус: coding, work, research, long-horizon tasks Рассказывать особо что то про модель не вижу смысла, это конкурентный монстр, лучше перенесу вам кейсы от разрабов, наслаждайтесь 🔘Coding 10+ дней самоэволюционирующего харнесса Модель с нуля построила проект oh-my-cli,...

5 дней назад
 • Вы подписаны

MiniMax H3

Опен сорс мультимодалка для генерации текста, изображений, видео и аудио в единой бесшовной системе 🔘Видео в 2K со стереозвуком, Модель генерирует ролики длиной до 15 секунд в нативном разрешении 2K, она сразу создает качественный стереозвук (голоса, эффекты и музыку) без костылей 🔘Гениальное понимание контекста, вы можете закинуть в промпт видео, картинку и аудио одновременно, просто написав: «Возьми движение камеры из Видео 1, заставь персонажа из Картинки 2 петь, используя вокал из Аудио 3» H3 сама всё поймет и сведет Генерация в 2K обходится более чем в 3 раза дешевле,...

Покупайте СтеллыИ дарите их за контент