- Опубликовано
https://claude.com/blog/new-in-claude-managed-agents
- Автор
- Имя
- ElKornacio
- Telegram
- ElKornacio14553 подписчика472 поста
Кратко
https://claude.com/blog/new-in-claude-managed-agentsAnthropic завезли "сны" для агентов в их облаке. этакая концепция само-рефлексии, где агент...
https://claude.com/blog/new-in-claude-managed-agents
Anthropic завезли "сны" для агентов в их облаке. этакая концепция само-рефлексии, где агент время от времени анализирует логи собственных сессий и прикидывает, где и что он мог бы сделать лучше, и какие новые скиллы/правила ему завести, чтобы стать ✨лучшей версией себя ✨
звучит конечно интересно, но учитывая регулярные проблемы моделей с овер-спецификациями (когда вместо выведения и редактирования общих паттернов они просто жестко зашивают себе в правила конкретные кейсы), не уверен, насколько хорошо оно сработает
вторая прикольная фича - outcomes. вы можете заранее сохранить "эталонный результат", набор требований, которые должны применяться к какому-то результату работы, и тогда, отдельная моделька (с отдельным контекстом) будет валидировать результат работы агента прежде чем он закончит работу.
sounds cool, если бы не bias моделей в self-review задачках (даже с чистым контекстом). не думаю, что Anthropic будут юзать для grader другие foundational-модели.
но несмотря на это, мне кажется, встраивание reality-check как обязательной части работы агента - это круто и полезно





