«Сбер» создает модель ИИ, которая может одновременно как говорить, так и слушать. Эта новая технология получила название «фулл-дуплекс». Об этом сообщил директор по развитию технологий ИИ «Сбербанка» Сергей Марков.

В настоящее время работа голосовых ассистентов осуществляется поочередно: сначала говорит пользователь, ИИ обрабатывает запрос, а затем предоставляет ответ. Новая технология позволяет применять одну модель для взаимодействия, а не каскадную систему. При этом она способна не только одновременно слушать и говорить, но и, используя видеомодальность, видеть собеседника и управлять движениями аватара.
Как сообщает издание РБК, аналогичные технологии можно встретить у французского стартапа Kyutai, который в 2024 году представил модель Moshi, а также у Google в Gemini Live и OpenAI в GPT-Live. «Фулл-дуплекс» позволяет ИИ отвечать в течение 160–320 миллисекунд, что сопоставимо с реакцией человека.
В России ранее никто не делал заявлений о данной технологии, однако у «Яндекса» есть схожая разработка – Realtime API, обеспечивающая быстрые ответы и возможность перебивания ассистента. Тем не менее, Марков утверждает, что данная модель все равно ожидает смены реплики, прежде чем ответить, тогда как «фулл-дуплекс» слушает непрерывно, даже когда говорит сам.
Ранее «Сбер» и «Работа.ру» запустили цифровую платформу для найма иностранных сотрудников. Это решение объединяет работодателей, зарубежных рекрутинговых партнеров и российские организации, которые занимаются оформлением и переездом работников. Презентация функционала платформы состоится на стенде «Сбера» на Восточном экономическом форуме.
В РФ футбольную аналитику улучшили с помощью ИИ


