Age of IT
Google выпустила Gemini 3.5 Transcribe — нейронку для перевода речи в текст
Она лучше понимает живую речь и сразу убирает слова-паразиты. - Удаляет «ээ», «мм» и автоматически форматирует текст; - Распознаёт больше 85 языков, включая русский; - Понимает акценты, диалекты и специфические термины; - Отделяет спикеров друг от друга; - Может передавать сложные задачи другим моделям Gemini. Вместо нескольких нейронок для расшифровки, чистки и оформления теперь можно использовать одну модель...
Сбер представил новое поколение GigaEmbeddings
🚀 Это модели для семантического поиска — пригодятся в поддержке, корпоративных базах знаний, а также при работе с юридическими и финансовыми документами. В линейке три версии: 480M — лидер среди русскоязычных моделей до 500 млн параметров; 3B — универсальная модель, качество обработки кода выросло с 62,37 до 76,93; 10B-A1.8B — MoE-флагман с 10 млрд общих и 1,8 млрд активных параметров...
Запускаем полноценную ИИ-видеостудию на 6ГБ ОЗУ — Wan2GP работает как опенсорсная замена Higgsfield
Тулза позволяет запустить фабрику по производству роликов: - Поддерживает text-to-video и image-to-video генерации; - Встроенные модели для генерации видео: Wan 2.2, LTX-2, Hunyuan Video, Flux; - Браузерный интерфейс с системой очередей; - Поддержка LoRA для дообучения моделей; - Встроенный редактор масок и улучшатель промптов; - Запустится даже...
Используем гигантские модели на ЛЮБОМ железе — нашли сервис FreeToken, который поставит большие МоЕ на простые ПК
Как это происходит: - Тулза до максимума оптимизирует вычисления, распределяя их между GPU, CPU и RAM; - Так, Qwen3.6 35B пойдёт на ноуте с RTX 4060 8 GB и будет выдавать 39 т/с; - Или какая DeepSeek-V4-Flash 284B полетит на RTX 5090 и выдаст до 25 т/с. полностью БЕСПЛАТНАЯ Ссылка Telegram: @Age_
