Глава 10 · Многоагентное взаимодействие¶
Коллективный интеллект может превзойти индивидуальный. Классификация мультиагентных систем, когда они действительно превосходят одиночного агента, сотрудничество с общим контекстом и без него, режимы сбоев и эмерджентное «общество агентов».
← К оглавлению · 📖 Читать главу
Сопутствующие проекты¶
| Эксп. | Проект | Тип | Описание |
|---|---|---|---|
| 10-1 | staged-system-prompt | ✅ | Один и тот же кодинг-агент на разных этапах исполнения задачи (уточнение требований → реализация кода → ревью кода) загружает разные системные промпты и наборы инструментов. Так он играет разные роли и ведёт себя по-разному в рамках одного диалога, при этом история диалога и состояние задачи непрерывно разделяются между этапами. Если ревью не пройдено, можно откатиться к этапу реализации. |
| 10-2 | multi-role-transfer | ✅ | Демонстрирует цепочечную передачу под общим контекстом: в одной сессии несколько специализированных ролевых агентов, у каждого свой системный промпт и выделенный набор инструментов. С помощью инструмента transfer_to_agent агент сам решает, когда переключиться на другую роль по ходу задачи. Поскольку они разделяют одну историю диалога, полный контекст естественно сохраняется при передаче. |
| 10-3 | book-translation | 🚧 | Для четырёхролевого Manager и одноагентного контроля есть малый прогон реальной модели. Для точной приёмки ещё нужна указанная в тексте техническая книга с большим числом иллюстраций и кода и полное сравнение качества, эффективности, токенов и ресурсов. |
| 10-4 | use-computer-while-calling/ |
📖 | Внешний TalkAct, зафиксированный на 7d70007…: fast/slow-агенты реально работают параллельно и обмениваются состоянием через внутрипроцессную доску SharedState (rolling digest, transcript/action log) и двунаправленные текстовые очереди. Эта версия не является WebSocket-мостом. Checkout не включён; точные команды clone и вход benchmark приведены в приложении главного README. |
| 10-5 | autonomous-phone-registration | 🚧 | Playwright наблюдает реальную форму, а реальная LLM автономно решает вызвать initiate_phone_call_agent; защищённый явным согласием путь Twilio/локального аудио поддерживает валидацию, повторный вопрос, параллельные опрос и заполнение, редактированные трассы и отправку только по флагу. Текущие артефакты подтверждают браузер/LLM/параллельность лишь со скриптовыми ответами; PSTN и человеческое аудио имеют статус not_run, поэтому живая приёмка не завершена. |
| 10-6 | parallel-web-research | ✅ | N независимых сессий Playwright ищут на десяти реальных сайтах университетов, а реальная LLM извлекает цитируемые доказательства. Сохранённая приёмка покрывает мониторинг, изоляцию timeout/error, однократное завершение, подтверждения каскадной остановки, очистку ресурсов и измеренное ускорение 3.142× на одном сайте. |
| 10-7 | generative_agents/ |
📖 | Генеративные агенты из стэнфордского «городка ИИ» (сопровождает эксперимент 10-7); внешний репозиторий joonspk-research/generative_agents, нужно клонировать самостоятельно (см. приложение в главном README) |
| 10-8 | voice-werewolf | 🚧 | Добавлен настоящий LLM-симулятор пользователя: он видит только контекст своего места, вызывает инструменты и входит в игру лишь через синтезированный звук и настоящий аудио-ASR OpenRouter. Строгая проверка отклонила два ранних запуска, где плохой транскрипт приняли за воздержание; корректный v2 прошёл E2E, изоляцию, победителя и три цикла, но провалил стратегию после ошибочного изгнания провидца жителем. |
| ## Типы проектов |
| Значок | Тип | Значение |
|---|---|---|
| ✅ | Автономный | Полный код в этом репозитории, запускается после настройки API-ключа |
| 📖 | Гайд по воспроизведению | Подробный документ, зависящий от внешних репозиториев через git clone |
| 🚧 | В процессе | Реализация или обязательные свидетельства приёмки неполны; рабочий код может существовать, но это не означает полную приёмку |