oh-my-agent: верификация работы AI-агентов с подтверждением задач

oh-my-agent: верификация работы AI-агентов с подтверждением задач

oh-my-agent — это инструмент для механической верификации работы AI-агентов, обеспечивающий контроль за выполнением задач. Он помогает убедиться, что агенты действительно выполняют свою работу, а не просто отчитываются о завершении.

Проект внедряет систему "стоп-хуков" и проверок артефактов, что делает процесс проверки фальсифицируемым. Вместо того чтобы полагаться на отчёты агентов, oh-my-agent требует подтверждения успешного завершения работы через проверку данных, которые должны были быть оставлены в результате выполнения. Это позволяет избежать ошибок, когда агенты заявляют, что все задачи выполнены, но не предоставляют реального подтверждения. Инструмент будет полезен разработчикам, работающим с AI-агентами и желающим повысить прозрачность результатов их работы.

Проект написан на JavaScript и доступен на npm. Убедись, что у тебя установлен Node.js, чтобы запустить его. Помни, что он все еще на ранней стадии разработки, а значит могут быть не все функции реализованы и согласованы.

oh-my-agent — это инструмент для работы с множеством агентов, который обеспечивает проверку их результатов. Он решает задачу, как убедиться, что агенты действительно выполнили свою работу. Проект позволяет создавать независимые проверки и согласно заданным критериям анализировать артефакты, оставленные агентами.

Зачем это нужно?

Агенты могут «говорить», что задача выполнена, но эта информация может быть неверной. oh-my-agent делает этот процесс подверженным проверке, заставляя каждый агентский сеанс выполнять проверку через специальные хуки. Например, Stop hook не позволит закончить сессию, пока не будут выполнены все проверки, такие как `typecheck`, `test`, `lint`. Решения о статусе работы фиксируются в журнале событий, который доступен для анализа после завершения работы.

Как установить и запустить

Для быстрого старта нужно установить пакет с помощью команды:

npx skills add first-fluke/oh-my-agent

Это установит необходимые навыки для агентов. Если нужно полное решение с хуками, командами CLI и дополнительными настройками, воспользуйся следующими командами:

curl -fsSL https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.sh | bash

или для Windows:

irm https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.ps1 | iex

Также возможна ручная установка, требующая определенных зависимостей:

bunx oh-my-agent@latest

Что он умеет?

oh-my-agent поддерживает различные типы агентов, которые разделяют рабочие потоки и обладают специализированными навыками в своих областях. Например:

  • oma-backend — создает и защищает API;
  • oma-frontend — разрабатывает пользовательский интерфейс;
  • oma-qa — проверяет код на наличие уязвимостей и производительных проблем;
  • oma-design — создает системы дизайна.

Ограничения

Система требует наличие определенных инструментов, таких как bun, uv и serena. Также, работа с артефактами зависит от конфигурации проекта, записанной в специальном файле настроек. При этом, все решения фиксируются в его логах, что обеспечивает простоту аудита действий агентов. Логика работы системы также не дозволяет произвольно менять параметры контроля и формирование рабочих процессов.

Заключение

oh-my-agent представляет собой мощный инструмент для автоматизации и проверки работы агентов, облегчая процесс разработки и тестирования в современных программных проектах. Это решение поможет организовать структурированный подход к взаимодействию агентов, а также обеспечит высокую степень контроля над их действиями.

Открыть на GitHub: first-fluke/oh-my-agent →

Что нового на GitHub — короткие обзоры на русском Новые обзоры приходят в Telegram. Без спама, по делу.
Подписаться

Похожие статьи

Популярные темы на сайте