Dograh: платформа для голосового ИИ с самохостингом и интеграциями
Dograh — это платформа для голосового ИИ с открытым исходным кодом и возможностью самохостинга, альтернатива Vapi и Retell. Она позволяет создавать голосовых агентов с визуальным конструктором рабочих процессов и поддерживает интеграцию с LLM, STT и TTS.
Основная задача Dograh — предоставить разработчикам гибкое и полностью контролируемое решение для создания голосовых приложений без зависимости от сторонних сервисов. В отличие от других платформ, Dograh делает акцент на открытости кода и предоставляет возможность настраивать интеграции по своему усмотрению. Этот проект будет полезен разработчикам, которые хотят избежать связанных с облаком проблем, получить больше контроля над данными и работать с голосовыми сервисами в своих приложениях.
Платформа написана на современных веб-технологиях и позволяет запустить её всего за 60 секунд с помощью одной команды. У проекта есть лицензия BSD 2-Clause, а это значит, что он подходит как для личного, так и для коммерческого использования. Следует учесть, что проект пока в активной разработке, и возможны нестабильности.
Что такое Dograh AI?
Dograh AI — это открытое, самостоятильное решение для создания голосовых агентов. Он представляет собой альтернативу таким продуктам, как Vapi и Retell, и позволяет быстро создавать и тестировать голосовые приложения с помощью визуального конструктора рабочих процессов. В проекте также предусмотрена интеграция с AI-ассистентами для редактирования и разработки кода.
Зачем это нужно?
С помощью Dograh можно создавать голосовых агентов для различных задач. Это решение подходит для разработчиков, которые хотят иметь полный контроль над своим кодом и инфраструктурой без привязки к сторонним поставщикам. Возможности Dograh позволяют интегрировать различные модели машинного обучения (LLM), синтез речи (TTS) и распознавание речи (STT).
Как установить и запустить Dograh?
Чтобы установить Dograh на своем компьютере, достаточно выполнить одну команду в терминале. Проект предоставляет скрипт для быстрой установки через Docker. Вот основные команды:
curl -o docker-compose.yaml https://raw.githubusercontent.com/dograh-hq/dograh/main/docker-compose.yaml && curl -o start_docker.sh https://raw.githubusercontent.com/dograh-hq/dograh/main/scripts/start_docker.sh && chmod +x start_docker.sh && ./start_docker.sh
После первого запуска потребуется несколько минут на загрузку всех необходимых изображений. После установки, открой браузер и перейди по адресу http://localhost:3010, чтобы создать своего первого голосового ассистента.
Основные возможности
- Визуальный конструктор рабочих процессов для создания голосовых агентов.
- Интеграция с различными телекоммуникационными сервисами, такими как Twilio и Vonage.
- Поддержка своей модели LLM, TTS и STT или использование встроенной.
- Разработка и использование агентов непосредственно внутри Dograh с помощью MCP-сервера для кодирования.
- Python и Node SDK для программатического создания агентов.
Ограничения
Хотя Dograh предлагает множество возможностей, следует учитывать, что может потребоваться время на настройку и изучение всех функций. Кроме того, отсутствует поддержка интеграций в SaaS-режиме, что может стать преградой для некоторых пользователей, привыкших к облачным решениям.
Заключение
Dograh AI — это мощный инструмент для разработчиков, желающих создать своих голосовых агентов с полной свободой и контролем. Открытость проекта и возможность самостроительства делают его привлекательной альтернативой многим коммерческим решениям.
Открыть на GitHub: dograh-hq/dograh →
RepoRadar