Параллельные агенты: минус 116 секунд ожидания, плюс 3,8x токенов
🛠 Параллельные агенты: минус 116 секунд ожидания, плюс 3,8x токенов
В эксперименте, описанном на Habr, один сценарий из трёх независимых задач — посадочная страница, письмо по базе и программа эфира — запустили на одной модели тремя способами: последовательно, параллельно через доску-оркестратор и вручную параллельно. Входные данные одинаковые: 6 файлов на 4141 слово. Последовательный запуск занял 423 секунды и стоил $2.74 по расчётному тарифу, параллельный через доску завершился за 307 секунд при $6.15. Ожидание сократилось в 1.38 раза, цена выросла в 2.24 раза.
Качество слепой агент-судья оценил в 52 балла у параллельного пути против 44 у последовательного. На посадочной странице и программе эфира параллельный вариант стабильно выше, а в письме перестановка порядка показывала преимущество то одному, то другому процессу. Автор сам фиксирует ограничение: это один запуск на одном наборе задач, а не серия повторных тестов. Контекст точнее объясняет переплату: параллельный запуск записал 532 128 токенов против 141 383 у последовательного — входные файлы просто копировались в три независимые ветки.
Ручной параллельный запуск дал близкие к доске цифры — 361 секунду ожидания и $5.73, хотя суммарное машинное время по его веткам не замеряли. Значит, основной эффект параллельности — изоляция контекста: агент письма не тащит историю посадочной, агент эфира не видит лишних материалов. Доска добавляет возможность наблюдать за состоянием веток, а не делает ответы умнее. Запускать задачи параллельно стоит не ради скорости, а ради чистоты контекста, и платить за это трёхкратным расходом токенов. Если сценарий разовый, оценка качества может обойтись дороже самой работы: в статье только слепая оценка — $8.85 при $23.47 на весь эксперимент.
#AIагенты #оркестрация #токены #Habr
Такие разборы выходят в канале каждый день — коротко и со ссылкой на первоисточник.