Российская компания Cubic Robotics объявила о создании уникальной операционной системы V.O.I.S. (Voice Operation Intellectual System). Она базируется на Android, но имеет полностью голосовое управление.
Как сообщают в своем блоге разработчики, голос — самый естественный способ общения для человека, именно поэтому они и разработали систему, управляемую исключительно голосом: «Мы верим, что скорейший путь к «говорящему миру» лежит через создание универсальной голосовой операционной системы, которую, с одной стороны, можно было бы установить на любое устройство. С другой стороны, такую систему могли бы развивать независимые разработчики по всему миру».
В компании подчеркивают, что V.O.I.S. — универсальная голосовая операционная система, и с ее помощью можно сделать говорящим почти любой предмет. «Разговаривать» в понимании Cubic Robotics — это не просто принимать голосовые команды, но действительно понимать человека, поддерживать и даже инициировать разговор. V.O.I.S. вполне можно назвать искусственным интеллектом.
V.O.I.S. представляет собой язык программирования, ядро системы и набор приложений, которые управляют различными речевыми функциями. Основной принцип ее работы — это умение понимать контекст разговора, эмулировать человеческую беседу. Человек задает вопрос и получает ответ, а не набор ссылок.
Перспективность российской операционной системы уже оценили в Samsung и КАМАЗе — на ее базе, скорее всего, будет работать голосовой интерфейс бортовых компьютеров нового поколения машин.
Cubic Robotics представила и первый гаджет на V.O.I.S. — робота-ассистента Cubic. Его продажи компания планирует начать уже этим летом. Стоимость — 20 000 рублей, в первой партии будет всего 100 роботов.
http://hi-tech.mail.ru/news/vois.html
http://cubicrobotics.ru/
зы
очень интересно, а насколько сложно программируя на "Вы" обеспечить такую связку
1. распознать голос (чем то)
2. Обработать данные (например диалог, сам напишу)
3. прочитать строку текста с выражением.
Обязателен ли андроид или можно сделать такое на дебиане?
В России создали голосовую операционную систему V.O.I.S.
Модератор: Модераторы разделов
-
azsx
- Сообщения: 3684
- ОС: calculate linux, debian, ubuntu
-
NickLion
- Сообщения: 3408
- Статус: аватар-невидимка
- ОС: openSUSE Tumbleweed x86_64
-
azsx
- Сообщения: 3684
- ОС: calculate linux, debian, ubuntu
Re: В России создали голосовую операционную систему V.O.I.S.
NickLion - ага???
-
NickLion
- Сообщения: 3408
- Статус: аватар-невидимка
- ОС: openSUSE Tumbleweed x86_64
Re: В России создали голосовую операционную систему V.O.I.S.
Во всяком случае то, что показано в ролике. Слишком хорошая речь. Слишком хорошее распознавание речи. Сказано:
Google далеко не идеально распознаёт речь. Тем более такого диктора как в ролике. Что за open source решение — не ясно. Но ни одной нормальной автоматической генерации речи не слышал. Пусть даже слова записаны заранее (ого-го словарик).
UPD Просто в том же ролике включите автоматические субтитры и любуйтесь как Google на самом деле понимает сказанное.
(http://rbcdaily.ru/business/562949991294475) писал(а):Распознавание голоса на «входе» основано на технологиях Google. Синтезирование речи на «выходе» основано на Open-Source решении.
Google далеко не идеально распознаёт речь. Тем более такого диктора как в ролике. Что за open source решение — не ясно. Но ни одной нормальной автоматической генерации речи не слышал. Пусть даже слова записаны заранее (ого-го словарик).
UPD Просто в том же ролике включите автоматические субтитры и любуйтесь как Google на самом деле понимает сказанное.
Спасибо сказали:
-
MrClon
- Сообщения: 838
- ОС: Ubuntu 10.04, Debian 7 и 6
Re: В России создали голосовую операционную систему V.O.I.S.
Распознавание голоса это задача скорее не для программиста, а для учёного. Работы в этом направлении ведутся и успехи таки-есть немалые (см. google speech api, siri, у яндекса что-то есть), но всё это в основном закрытое (можно использовать через API, но сама работа происходит на чужом сервере). Вроде-бы проскакивало на ЛОРе что кто-то пилит свободный инструментарий (а может мне только кажется).
Синтез речи это довольно просто. Есть готовые свободные решения (см. festival), русские голоса там весьма убогие, но на сколько я понимаю это просто от того что никто в достаточной степени не озаботился допиливанием.
Что ты подразумеваешь под «обработать данные». Если просто проход по дереву возможных вариантов (заранее заданному), на манер диалогов в некоторых играх, то тут никаких проблем. А если хочется как в HAL 9000 в «Космической одиссеи» то это опять-таки к учёным. Передовой рубеж computer science, все дела. На сколько я понимаю пока-что есть только весьма ограниченные успехи в этой области, можно создавать экспертные системы по каким-то определённым областям знания. Например доклад кого-то из мешделмаша про их Ватсона. Кстати там-же было про распознавание речи, правда на английском.
Если совсем интересно то то-ли Стэнфорд, то-ли Беркли регулярно (кажется) устраивают бесплатные онлайн курсы по искусственному интеллекту и машинному обучению (два разных курса). Что-то похожее (без ИИ) есть на русском в программе Computer Science Center (не знаю на сколько адекватно).
Программировать не умея программировать вообще трудно. Если очень хочется поговорить с компьютером, поищи какую-то готовую поделку (таких поделок к общем-то хватает, но это именно поделки) например на том-же ЛОРе проскакивало что-то использующее гугловый api для распознавания голоса. Или прими чего-то не очень законного и не очень полезного, сможешь не столько с компом разговаривать, но и со стенами, мебелью или богом, как поведёт. А лучше забей на это. Кто сказал что это удобно? Это прикольно. А ещё лучше просто подтяни навыки программирования, всяко пригодится по жизни. Рекомендую например «Изучаем Python» Лутца.
Синтез речи это довольно просто. Есть готовые свободные решения (см. festival), русские голоса там весьма убогие, но на сколько я понимаю это просто от того что никто в достаточной степени не озаботился допиливанием.
Что ты подразумеваешь под «обработать данные». Если просто проход по дереву возможных вариантов (заранее заданному), на манер диалогов в некоторых играх, то тут никаких проблем. А если хочется как в HAL 9000 в «Космической одиссеи» то это опять-таки к учёным. Передовой рубеж computer science, все дела. На сколько я понимаю пока-что есть только весьма ограниченные успехи в этой области, можно создавать экспертные системы по каким-то определённым областям знания. Например доклад кого-то из мешделмаша про их Ватсона. Кстати там-же было про распознавание речи, правда на английском.
Если совсем интересно то то-ли Стэнфорд, то-ли Беркли регулярно (кажется) устраивают бесплатные онлайн курсы по искусственному интеллекту и машинному обучению (два разных курса). Что-то похожее (без ИИ) есть на русском в программе Computer Science Center (не знаю на сколько адекватно).
Программировать не умея программировать вообще трудно. Если очень хочется поговорить с компьютером, поищи какую-то готовую поделку (таких поделок к общем-то хватает, но это именно поделки) например на том-же ЛОРе проскакивало что-то использующее гугловый api для распознавания голоса. Или прими чего-то не очень законного и не очень полезного, сможешь не столько с компом разговаривать, но и со стенами, мебелью или богом, как поведёт. А лучше забей на это. Кто сказал что это удобно? Это прикольно. А ещё лучше просто подтяни навыки программирования, всяко пригодится по жизни. Рекомендую например «Изучаем Python» Лутца.
Спасибо сказали: