2 дня назад
Xiaomi выпустила ИИ-модель CocktailASR-1 для распознавания речи в шумных помещениях
Xiaomi представила открытую модель искусственного интеллекта CocktailASR-1. Она предназначена для решения одной из наиболее сложных задач в области расшифровки аудио — выделения голоса конкретного человека в ситуации, когда несколько людей говорят одновременно. В Xiaomi проблему условно обозначили как «эффект коктейльной вечеринки». Большинство специализированных ИИ-моделей справляются с распознаванием речи, когда говорит один человек, но если друг на друга накладываются несколько голосов, ситуация значительно усложняется...
В России созданы новые ИИ-модели для многошаговых агентских задач
Компания MWSAI (МТС WebServices), которая помогает бизнесу внедрять решения с искусственным интеллектом, выпустила CotypePro 3 и CotypeLight 3. Это языковые модели третьего поколения. Они могут одновременно работать с текстом и изображением. По прогнозам экспертов, они позволят быстрее обрабатывать сообщения, ускорить подготовку документов, а также автоматизировать кадровые и банковские операции. По словам разработчиков, размер моделей CotypePro 3 и CotypeLight 3 –27 и 9 млрд параметров. Они созданы...