Даже в спокойные дни для крупных релизов долгоживущие агентные системы выявляют новые практические сложности, связанные с согласованностью и дизайном рабочих процессов.

По мере того как модели лучше справляются с длительной многошаговой работой, становятся заметными проблемы вроде внутреннего «диалектного дрейфа» и отсутствия устоявшихся паттернов для долгоживущих агентов.

1. «Басня» (Fable) вырабатывает собственный внутренний диалект во время долгих задач

Итан Моллик показал, что когда Fable выполняет расширенные агентные сценарии (например, создание сложных интерактивных игр), она начинает вырабатывать собственный причудливый внутренний ритм и манеру диалога, которые могут просачиваться в выходные данные, если ими активно не управлять.
Источник: x.com/emollick/statu…

Долгоживущие агенты мощные, но могут становиться несогласованными без надлежащих ограничителей.

Управление дрейфом тона и поведения станет ключевым операционным навыком по мере того, как агентные сессии будут длиться дольше.

2. Лучшие практики для долгоживущих агентов пока еще не до конца разработаны

Моллик отметил, что сообщество всё ещё выясняет, как лучше организовывать работу и устанавливать защитные ограждения для агентов, выполняющих множество шагов или часов, при этом сколько‑нибудь устоявшейся методологии пока нет.
Источник: x.com/emollick/statu…

Когда агентные системы берутся за более крупные задачи, архитектура рабочих процессов становится столь же важной, как и возможности модели.

Команды, которые первыми выработают сильные паттерны для долгоживущих агентов, получат существенное преимущество.

Вывод для разработчиков

Сигналы показывают, что хотя агентные возможности продолжают совершенствоваться, появляются новые операционные вызовы, связанные с согласованностью и дизайном рабочих процессов для долгоживущих агентов. Разработчикам стоит начинать экспериментировать со структурой, мониторингом и защитными ограничителями для длительных агентных сессий, а не воспринимать их как простые инструменты «одного выстрела». Преимущество получат те, кто рассматривает управление долгоживущими агентами как задачу первоклассного дизайна, а не как запоздалую мысль.

Следующее преимущество достанется командам, которые способны запускать агентов на протяжении часов, не позволяя им «уплывать» в собственный странный внутренний мир.