oh-my-agent: верификация работы AI-агентов с подтверждением задач
oh-my-agent — это инструмент для механической верификации работы AI-агентов, обеспечивающий контроль за выполнением задач. Он помогает убедиться, что агенты действительно выполняют свою работу, а не просто отчитываются о завершении.
Проект внедряет систему "стоп-хуков" и проверок артефактов, что делает процесс проверки фальсифицируемым. Вместо того чтобы полагаться на отчёты агентов, oh-my-agent требует подтверждения успешного завершения работы через проверку данных, которые должны были быть оставлены в результате выполнения. Это позволяет избежать ошибок, когда агенты заявляют, что все задачи выполнены, но не предоставляют реального подтверждения. Инструмент будет полезен разработчикам, работающим с AI-агентами и желающим повысить прозрачность результатов их работы.
Проект написан на JavaScript и доступен на npm. Убедись, что у тебя установлен Node.js, чтобы запустить его. Помни, что он все еще на ранней стадии разработки, а значит могут быть не все функции реализованы и согласованы.
oh-my-agent — это инструмент для работы с множеством агентов, который обеспечивает проверку их результатов. Он решает задачу, как убедиться, что агенты действительно выполнили свою работу. Проект позволяет создавать независимые проверки и согласно заданным критериям анализировать артефакты, оставленные агентами.
Зачем это нужно?
Агенты могут «говорить», что задача выполнена, но эта информация может быть неверной. oh-my-agent делает этот процесс подверженным проверке, заставляя каждый агентский сеанс выполнять проверку через специальные хуки. Например, Stop hook не позволит закончить сессию, пока не будут выполнены все проверки, такие как `typecheck`, `test`, `lint`. Решения о статусе работы фиксируются в журнале событий, который доступен для анализа после завершения работы.
Как установить и запустить
Для быстрого старта нужно установить пакет с помощью команды:
npx skills add first-fluke/oh-my-agent
Это установит необходимые навыки для агентов. Если нужно полное решение с хуками, командами CLI и дополнительными настройками, воспользуйся следующими командами:
curl -fsSL https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.sh | bash
или для Windows:
irm https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.ps1 | iex
Также возможна ручная установка, требующая определенных зависимостей:
bunx oh-my-agent@latest
Что он умеет?
oh-my-agent поддерживает различные типы агентов, которые разделяют рабочие потоки и обладают специализированными навыками в своих областях. Например:
- oma-backend — создает и защищает API;
- oma-frontend — разрабатывает пользовательский интерфейс;
- oma-qa — проверяет код на наличие уязвимостей и производительных проблем;
- oma-design — создает системы дизайна.
Ограничения
Система требует наличие определенных инструментов, таких как bun, uv и serena. Также, работа с артефактами зависит от конфигурации проекта, записанной в специальном файле настроек. При этом, все решения фиксируются в его логах, что обеспечивает простоту аудита действий агентов. Логика работы системы также не дозволяет произвольно менять параметры контроля и формирование рабочих процессов.
Заключение
oh-my-agent представляет собой мощный инструмент для автоматизации и проверки работы агентов, облегчая процесс разработки и тестирования в современных программных проектах. Это решение поможет организовать структурированный подход к взаимодействию агентов, а также обеспечит высокую степень контроля над их действиями.
Открыть на GitHub: first-fluke/oh-my-agent →
RepoRadar