Попался ролик на два часа в VK Видео или RuTube. Тема нужная: лекция, интервью, вебинар, разбор закона, запись конференции. Открываешь, смотришь первые минуты и понимаешь: сейчас на это просто нет времени. Хочется сделать по-человечески: дать сервису ссылку и получить краткое содержание видео. Без скачивания программ, без Python, без установки расширений, без танцев с API. Но тут начинается неприятная часть. ChatGPT, Gemini и похожие ИИ-чаты не всегда понимают, что лежит по ссылке на российской видеоплатформе...
Speech2Text
Михаил Бурцев: «Пока мы не создали мультимодальную модель, говорить о суперинтеллекте рано»
Почему рекордные инвестиции в искусственный интеллект пока не превратились в рост производительности и что об этом думает исследователь нейросетей и мозга. Искусственный интеллект уже стал одной из главных статей расходов мировой технологической индустрии, но обещанный скачок производительности пока остается скорее ожиданием, чем фактом. Михаил Бурцев смотрит на этот разрыв с двух сторон: как математик, исследующий машинный интеллект, и как нейрофизик, хорошо понимающий, насколько сегодняшние модели не похожи на живой мозг. Из этого разговора получается не очередной прогноз о скором AGI, а трезвый...
Антон Коченевский: «GEO — это не новый SEO, а новая логика видимости бизнеса»
Основатель Semantica AI — о том, как AI-поиск меняет маркетинг, почему компаниям придется шире работать с контентом и зачем бизнесу думать не только о ссылках, но и о доверии нейросетей. AI-поиск уже забирает у классической выдачи внимание пользователя, но для бизнеса это не просто новая полка в маркетинговом бюджете. В этой реальности бренд должен быть понятен машине, присутствовать в источниках, которым она доверяет, и уметь отвечать на вопросы клиентов до того, как они попали в форму заявки. Антон Коченевский, основатель Semantica AI, разбирает GEO как практику: от первых метрик и ограничений до корпоративных медиа, MCP и внутренних AI-инструментов...
Как перевести запись лекции или вебинара в текст: делаем ИИ-конспект без рутины
Полуторачасовая лекция без тайм-кодов, длинный вебинар перед сессией, запись пары с шумом аудитории — и потом еще нужно вручную собирать конспект. Знакомо? Слушать на скорости 2x, ставить на паузу каждые 20 секунд и пытаться одновременно писать тезисы — уже не рабочий сценарий для студентов, преподавателей и слушателей онлайн-курсов. Намного быстрее перевести запись лекции в текст онлайн бесплатно или с минимальными затратами, а затем получить не просто расшифровку, а готовую выжимку с главными мыслями, определениями и тезисами...
Когда Америка была другой. История исчезнувшего мира
Сегодня делимся материалом о колонизации Северной Америки. Если вам кажется, что вы хорошо знаете историю «ковбоев против индейцев», приготовьтесь удивиться. За знакомым сюжетом вестернов скрывается куда более сложная и трагичная история, в которой всё оказалось совсем не так, как принято считать. Началось всё красиво. Европейцы узнали, что за океаном лежит богатая земля. «Реки, полные рыбой, моря с жемчугом, леса с гигантскими деревьями. Вот прямо просто приезжай и бери, что не хочу. Есть только один маленький нюансик...
Как разделить расшифровку по спикерам: диаризация Whisper и готовое решение через API
Вы загрузили запись разговора в Whisper, дождались обработки и получили точный, но почти бесполезный текст: добрый день вы оставляли заявку на подключение телефонии да нам нужно записывать звонки менеджеров сколько человек работает в отделе сейчас восемь но планируем расширяться Слова распознаны правильно, однако непонятно, где говорит клиент, а где менеджер. Такой результат сложно передать в CRM, использовать для контроля качества звонков или отправить в нейросеть для подготовки резюме. После разделения по голосам та же запись выглядит иначе: Менеджер: Добрый день...
