Представьте себе обычное утро: вы ещё пытаетесь урвать хотя бы пять минут сна, а ваш кот уже сидит у изголовья и выдает требовательную трель. Вы тянетесь не к миске с кормом, а к смартфону, потому что на экране высвечивается уведомление: «Я голодна, покорми меня немедленно». Ещё пару лет назад такой сценарий показался бы фрагментом фантастического фильма, а сегодня это реальность, которую предлагают частные продавцы на российских маркетплейсах. Они привозят из Китая и Гонконга небольшой гаджет PettiChat — клипсу на ошейник, которая обещает переводить мяуканье и лай на человеческий язык. Официального дистрибьютора в стране нет, поэтому цена ощутимо кусается: около четырнадцати тысяч рублей при исходной стоимости от ста девятнадцати до ста девяноста девяти долларов. Прибор не произносит фразы голосом, как можно было бы ожидать, а примерно за секунду с небольшим отправляет в приложение короткое текстовое сообщение. И пока владельцы кошек и собак делятся первыми восторженными скриншотами, учёные и ветеринары советуют не торопиться с выводами.
Что внутри у переводчика: микрофоны, акселерометр и гибридный мозг
Внешне устройство напоминает небольшую пластиковую коробочку, которая крепится на обычный ошейник и почти не мешает питомцу двигаться. Однако за скромным дизайном скрывается довольно сложная начинка: несколько сверхчувствительных микрофонов, настроенных на широкий диапазон звуков — от низкого рычания до едва слышного мурлыканья. Параллельно с ними в корпусе трудятся акселерометр и датчики движения, которые непрерывно фиксируют позу животного, наклон головы, резкие повороты и общий уровень активности. Зачем это нужно? Разработчики из ханчжоуской компании Meng Xiaoyi справедливо рассудили, что один и тот же звук может означать разное в зависимости от того, лежит ли питомец, расслабившись, или напряжённо выгибает спину. Именно поэтому инженеры объединили аудиопоток и данные с датчиков в единую гибридную систему обработки, которую назвали PETTI.
Часть вычислений гаджет производит прямо на борту, чтобы максимально сократить задержку, а тяжелый анализ уходит в облачную инфраструктуру. Там в дело вступает большая языковая модель Qwen от Alibaba, которую целенаправленно доучили на огромном массиве звуков, записанных у домашних питомцев. Алгоритм раскладывает каждый полученный сигнал на высоту тона, частоту, длительность и ритмический рисунок, после чего сравнивает этот акустический узор с базой из полутора миллионов размеченных образцов. Сбор этой базы, по словам создателей, занял два года: они записали тысячи кошек и собак более пятидесяти пород в самых разных ситуациях — от радостной встречи хозяина до визита к ветеринару. Движения и звуки система превращает в так называемые поведенческие токены, а затем обрабатывает их трансформерной архитектурой, похожей на ту, что расшифровывает текст в популярных чат-ботах.
В результате обработки алгоритм выбирает одно из более чем двадцати эмоциональных состояний. Среди них есть и очевидный голод, и тревога, и игровой азарт, и боль, и желание внимания, и даже территориальная настороженность — та самая, что заставляет собаку заливаться лаем, заслышав шаги за дверью. Определив эмоцию, нейросеть превращает её в короткую и понятную фразу на русском языке, которая через мгновение появляется на экране смартфона. Важно понимать: это не дословный перевод с кошачьего или собачьего в привычном смысле слова, потому что у животных нет фиксированного словаря, каждое «мяу» которого строго соответствует слову «корм». Модель пытается уловить общий эмоциональный фон, опираясь на статистику и данные с датчиков, и именно в этом заключается главная инженерная интрига. Основатель стартапа Ли Цзинъюань так описал замысел: «для людей уже существуют большие мультимодальные модели, но команда хочет построить похожую модель мира и для животных, которая объединит зрение, звук и поведение». Амбиция, надо признать, захватывает дух.
Не просто переводчик: обратная связь, GPS-трекинг и персональный подход
Любопытнее всего, что PettiChat пытается работать и в обратную сторону. В приложении предусмотрено поле, куда хозяин может впечатать короткую фразу вроде «иди сюда» или «всё хорошо», и устройство воспроизведёт специально синтезированный звук. По задумке инженеров, этот звуковой сигнал должен быть инстинктивно понятен собаке или кошке — не как развернутое предложение, конечно, а скорее как эмоционально окрашенный акустический якорь. К примеру, можно попытаться успокоить питомца, если датчики зафиксировали резкий всплеск тревоги, или подозвать его с прогулки, не используя команду голосом, а просто отправив сигнал с телефона. Конечно, полноценным диалогом это назвать трудно, но сама возможность двусторонней, пусть и предельно упрощённой, коммуникации выглядит необычно и выделяет гаджет на фоне многочисленных предшественников, которые умели лишь классифицировать звуки.
Помимо экспериментов с обратным переводом, приложение превращается в настоящий центр наблюдения за питомцем. Оно хранит всю историю расшифрованных сообщений, позволяя хозяину в конце дня увидеть своеобразный дневник настроений: сколько раз кот просил есть, когда испытывал стресс и в какие моменты требовал ласки. Вдобавок в клипсу встроен GPS-модуль, и ошейник становится маячком, который показывает местоположение любимца на карте. Для владельцев кошек, гуляющих на даче, и для хозяев собак, склонных к побегам, эта функция может оказаться даже полезнее самого переводчика. Нейросеть, по заверению разработчиков, со временем адаптируется к конкретному животному: чем дольше вы пользуетесь устройством, тем точнее оно распознаёт оттенки голоса именно вашего питомца и привычные ему поведенческие паттерны. Алгоритм словно знакомится с мохнатым пользователем и подстраивается под его манеру общения.
Стартап Meng Xiaoyi зарегистрировали совсем недавно, в январе 2026 года, но подготовительная работа шла гораздо раньше. Два года ушло только на то, чтобы собрать и разметить обучающие данные, причём к разметке привлекали не просто волонтёров, а практикующих ветеринаров и зоопсихологов, которые профессионально интерпретировали позы и звуки животных. Тестирование проводили более чем на тысяче реальных кошек и собак, стараясь охватить максимально разнообразные породы и жизненные сценарии. Основатель проекта Ли Цзинъюань не раз подчёркивал в интервью, что конечная цель гораздо шире, чем просто продажа забавного гаджета: его команда мечтает создать полноценную модель мира, увиденного глазами и услышанного ушами животного. Пока же мы имеем компактную пластиковую клипсу за четырнадцать тысяч рублей и приложение с кнопкой «перевести», и именно на этом этапе смелые алгоритмы сталкиваются с отрезвляющей реальностью.
Учёные сомневаются: почему 94,6 процента точности пока под вопросом
Цифра 94,6 процента точности для кошек и 92,3 процента для собак, которую охотно цитируют маркетинговые материалы, звучит почти как приговор любому скепсису. Однако научное сообщество встречает эти показатели сдержанным молчанием, потому что ни одна независимая лаборатория их пока не подтвердила. Более того, исследования, на которые ссылаются профильные издания, рисуют заметно более скромную картину: если анализировать одни только звуки, без учёта видео и языка тела, точность предсказания намерений падает примерно до 57 процентов. И лишь когда аудиодорожка объединяется с визуальным контекстом и данными о позе животного, результат поднимается до 89 процентов. Разница между этим показателем и заявленными компанией величинами очевидна даже неспециалисту, и она заставляет задуматься о методике, которую использовали внутренние тестировщики стартапа.
Специалисты по поведению животных напоминают о фундаментальной ловушке, в которую легко угодить, пытаясь переводить лай или мяуканье в текст. Смысл одного и того же звука может кардинально меняться в зависимости от контекста, который миниатюрный датчик на ошейнике далеко не всегда способен уловить. Собака может заливаться лаем у пустой миски, требуя ужина, и точно таким же лаем реагировать на проезжающий за окном грузовик, защищая территорию, — мотивация в этих двух случаях совершенно разная, хотя акустический рисунок может быть почти неотличим. Маленький микрофон не видит, куда направлен взгляд животного, не фиксирует напряжение мускулов на спине и характерный рисунок дыхания, который опытный хозяин считывает интуитивно. Поэтому даже самая продвинутая нейросеть рискует систематически путать тревогу с азартом или пропускать сигнал боли, если питомец не издаёт характерного поскуливания, а лишь меняет позу и замирает.
Ещё одна серьёзная проверка для устройства — условия обычной городской квартиры, где одновременно работает телевизор, гудит пылесос, за стеной шумят соседи, а в соседней комнате разговаривают домочадцы. Человеческие системы распознавания речи, обученные на гигантских массивах данных, до сих пор далеко не всегда безупречно работают в шумной среде, а здесь приходится иметь дело с гораздо более вариативными и малопредсказуемыми звуками животных. Разработчики PettiChat заявляют, что часть фильтрации шумов выполняется прямо на устройстве, но никаких независимых тестов в реальных, а не стерильных лабораторных условиях пока не проводилось. Именно эта зона неопределённости и вызывает больше всего вопросов у инженеров-акустиков, которые понимают, насколько трудно вычленить тихое мурлыканье на фоне работающей стиральной машины.
История знает немало попыток создать переводчик с языка животных, и все они, при всём первоначальном энтузиазме, не получили серьёзного научного признания. В девяностых японцы выпускали устройство BowLingual, которое обещало расшифровывать собачий лай, позже появилось мобильное приложение MeowTalk для кошек, и оба проекта довольно быстро превратились в нишевые игрушки. На этом фоне настоящая наука движется гораздо осторожнее и сложнее: например, проект CETI расшифровывает щелчки кашалотов, а команда Google DeepMind разработала специализированную модель DolphinGemma для анализа коммуникации дельфинов, но даже там никто не говорит о переводе в бытовом смысле. Сами создатели PettiChat, надо отдать им должное, не скрывают ограничений и честно признают, что прибор не заменит ни собственного понимания, ни той глубинной связи, которая годами выстраивается между человеком и питомцем. По сути, за четырнадцать тысяч рублей вы получаете технологичную и забавную новинку с любопытным алгоритмом внутри — повод улыбнуться, глядя на экран смартфона, и, возможно, чуть лучше узнать привычки своего любимца, но вовсе не магический ключ к его мыслям.
Подписывайтесь на канал, чтобы не пропустить новые статьи и ставьте нравится.