跳转至

Глава 10 · Многоагентное взаимодействие

Коллективный интеллект может превзойти индивидуальный. Классификация мультиагентных систем, когда они действительно превосходят одиночного агента, сотрудничество с общим контекстом и без него, режимы сбоев и эмерджентное «общество агентов».

К оглавлению · 📖 Читать главу

Сопутствующие проекты

Эксп. Проект Тип Описание
10-1 staged-system-prompt Один и тот же кодинг-агент на разных этапах исполнения задачи (уточнение требований → реализация кода → ревью кода) загружает разные системные промпты и наборы инструментов. Так он играет разные роли и ведёт себя по-разному в рамках одного диалога, при этом история диалога и состояние задачи непрерывно разделяются между этапами. Если ревью не пройдено, можно откатиться к этапу реализации.
10-2 multi-role-transfer Демонстрирует цепочечную передачу под общим контекстом: в одной сессии несколько специализированных ролевых агентов, у каждого свой системный промпт и выделенный набор инструментов. С помощью инструмента transfer_to_agent агент сам решает, когда переключиться на другую роль по ходу задачи. Поскольку они разделяют одну историю диалога, полный контекст естественно сохраняется при передаче.
10-3 book-translation 🚧 Для четырёхролевого Manager и одноагентного контроля есть малый прогон реальной модели. Для точной приёмки ещё нужна указанная в тексте техническая книга с большим числом иллюстраций и кода и полное сравнение качества, эффективности, токенов и ресурсов.
10-4 use-computer-while-calling/ 📖 Внешний TalkAct, зафиксированный на 7d70007…: fast/slow-агенты реально работают параллельно и обмениваются состоянием через внутрипроцессную доску SharedState (rolling digest, transcript/action log) и двунаправленные текстовые очереди. Эта версия не является WebSocket-мостом. Checkout не включён; точные команды clone и вход benchmark приведены в приложении главного README.
10-5 autonomous-phone-registration 🚧 Playwright наблюдает реальную форму, а реальная LLM автономно решает вызвать initiate_phone_call_agent; защищённый явным согласием путь Twilio/локального аудио поддерживает валидацию, повторный вопрос, параллельные опрос и заполнение, редактированные трассы и отправку только по флагу. Текущие артефакты подтверждают браузер/LLM/параллельность лишь со скриптовыми ответами; PSTN и человеческое аудио имеют статус not_run, поэтому живая приёмка не завершена.
10-6 parallel-web-research N независимых сессий Playwright ищут на десяти реальных сайтах университетов, а реальная LLM извлекает цитируемые доказательства. Сохранённая приёмка покрывает мониторинг, изоляцию timeout/error, однократное завершение, подтверждения каскадной остановки, очистку ресурсов и измеренное ускорение 3.142× на одном сайте.
10-7 generative_agents/ 📖 Генеративные агенты из стэнфордского «городка ИИ» (сопровождает эксперимент 10-7); внешний репозиторий joonspk-research/generative_agents, нужно клонировать самостоятельно (см. приложение в главном README)
10-8 voice-werewolf 🚧 Добавлен настоящий LLM-симулятор пользователя: он видит только контекст своего места, вызывает инструменты и входит в игру лишь через синтезированный звук и настоящий аудио-ASR OpenRouter. Строгая проверка отклонила два ранних запуска, где плохой транскрипт приняли за воздержание; корректный v2 прошёл E2E, изоляцию, победителя и три цикла, но провалил стратегию после ошибочного изгнания провидца жителем.
## Типы проектов
Значок Тип Значение
Автономный Полный код в этом репозитории, запускается после настройки API-ключа
📖 Гайд по воспроизведению Подробный документ, зависящий от внешних репозиториев через git clone
🚧 В процессе Реализация или обязательные свидетельства приёмки неполны; рабочий код может существовать, но это не означает полную приёмку