Skip to content
Dmitry Che edited this page Apr 4, 2016 · 6 revisions

Агрегат

Что такое Агрегат

Агрегат - это платформа голосового управления, позволяющая выполнять различные операции на компьютере с помощью голосовых команд.

Как это работает

Вы активируете Агрегат и произносите команду. Агрегат распознает ее и выполняет запрошенную операцию. При необходимости он что-то уточняет у вас, переходя в режим диалога.

Результат команды может быть или просто озвучен синтезатором речи, или может открыться какая-то программа (например браузер на нужной странице), или выполнится какое-то действие на вашем смартфоне, и так далее. Функционал при этом ничем не ограничен.

Посмотрите небольшое видео о том, как это работает

Видео демо

Что умеет Агрегат

Агрегат - это модульная система, похожая на конструктор Lego. Пользователь сам выбирает, какие функции ему нужны, и скачивает соответствующие модули для своего Агрегата.

При этом любой разработчик может создать какие-угодно голосовые модули, которые смогут выполнять функции любой сложности. Агрегат предоставляет очень гибкие возможности по управлению диалоговыми контекстами, распознаванию и синтезу речи, а также взаимодействию модулей между собой.
Он реализует все сложности, связанные с этими вопросами, так что разработчику нужно лишь реализовать свою идею, не вдаваясь в детали голосового управления.

Особенности

  • Может работать с любым языком (русский, английский и так далее).
  • Работает на любом компьютере с любой операционной системой (Windows, Linux или Mac OS).
  • Работает даже на микрокомпьютерах типа Raspberry Pi.
  • Работает в фоне и не мешает другим программам.
  • Агрегат - это очень гибкая система, которая состоит из модулей и может наращиваться и настраиваться как угодно.
  • Может управлять любой удаленной техникой, включая смартфоны, умные дома и так далее.
  • Есть открытый API для сторонних разработчиков, с помощью которого можно создавать свои модули голосовых функций, распознавания и синтеза речи, а также модули активаций.
  • Поддерживает сразу несколько языков программирования (на данный момент это Java, Javascript, Typescript, Groovy, Ruby).
  • Не нужно быть специалистом в области искусственного интеллекта, чтобы разрабатывать голосовые функции.
  • Исходные коды всех модулей открыты.

Где скачать и как настроить

В данный момент проходит этап открытого альфа-тестирования проекта. Чтобы подключиться к нему, необходимо стать участником сообщества Google+ и написать запрос на art@dusi.mobi

О процедуре установки и настройки читайте в разделе Руководство Пользователя.

Чтобы узнать, как разработать свои голосовые функции, прочитайте Руководство Разработчика.

Как использовать в коммерческом проекте

Проект распространяется по лицензии GPL-v3. Чтобы использовать его как часть собственного коммерческого проекта, отправьте пожалуйста запрос на art@dusi.mobi

Russian Version (Русская версия)





IDE


English Version

Main Page

Modules

  • List of available modules

User Guide

  • Where to get

  • How to install

  • How to use

  • Setting up


Developer Guide

Aggregate Architecture

Events List

Command Line


How to Create a Module

  • Java
  • Javascript
  • Typescript
  • Groovy
  • Ruby

Functional Modules

  • Query grammar

  • Pattern syntax

  • Dynamic patterns

  • Standard patterns

Activation Modules

Speech Recognition Modules

Text-to-Speech Modules


IDEs

  • Developing in Eclipse
  • Developing in IntelliJ IDEA

Change Log

Clone this wiki locally