Теперь модель умеет продолжать готовую сцену, анализируя до 10 секунд предыдущего видео. Ролик можно наращивать кусками по 10 секунд вплоть до общей длины 40 секунд. Еще одна полезная функция позволяет задать первый и последний кадр. Модель сама построит между ними плавное движение камеры или переход без склеек. Для быстрых тестов появился режим 360p. Такие черновики генерируются до 60% быстрее и стоят примерно втрое дешевле версии в 720p. Финальный результат затем можно вывести в 1080p или 4K...
Ринат Шакиров / Нейросети / ChatGPT / Midjourney
Claude Cowork получил собственный браузер и теперь может работать с сайтами без расширений
Когда задача требует открыть сайт, браузер запускается прямо внутри приложения Claude. Агент сам переходит по страницам, читает их, нажимает кнопки и заполняет формы. Например, можно поручить Claude собрать данные из личного кабинета, скачать счета с портала поставщика или заполнить форму. Ваши обычные вкладки, закладки и пароли он при этом не видит. Авторизации можно отдельно перенести из Chrome, Edge или Firefox для нужных сайтов...
Nvidia договорилась купить Hugging Face за $12,9 млрд
По данным The Information, стороны уже пришли к соглашению. При этом Business Insider пишет, что документы пока не подписаны и сделка еще может сорваться. Для Nvidia это отличный шаг. Ведь OpenAI, Google, Amazon и Anthropic создают собственные чипы и пытаются меньше зависеть от Nvidia. Чем сильнее будет рынок открытых моделей, тем больше разработчиков останутся потенциальными покупателями железа Nvidia. Плюс Hugging Face может вернуть Nvidia глубже в облачный бизнес. Компания уже позволяет запускать...
Контур стран и городов из вышивки
КАК ПОВТОРИТЬ: переходим в VeoSeeBot или на САЙТ, Работа с изображениями, GPT Image 2: Создайте потрясающее вертикальное произведение искусства в стиле роскошных путешествий с соотношением сторон 4:5, на котором весь силуэт [НЬЮ-ЙОРК] будет искусно выполнен вручную с использованием аутентичной кашмирской вышивки созни. Сама страна полностью выткана из тончайших нитей с использованием изящных цветочных лоз, пейсли-узоров, листьев чинары, цветков миндаля, традиционных кашмирских узоров и элегантных деталей в персидском стиле...
Google выпустила Gemini 3.5 Transcribe
Это новая модель для перевода речи в текст. Она умеет не просто записывать сказанное, а сразу превращать речь в чистый и нормально оформленный текст. Модель сама убирает слова-паразиты, понимает исправления на ходу и может работать с профессиональными терминами. Поддерживается более 85 языков, разные акценты и несколько говорящих. Для записанных разговоров Gemini 3.5 Transcribe умеет определять собеседников и ставить временные метки для отдельных слов. В реальном времени задержка составляет меньше секунды. По тестам Artificial Analysis ошибка распознавания составляет 2,6% для записанного аудио и 4% для потоковой речи...
