Перейти к содержимому
Опубликовано

https://claude.com/blog/new-in-claude-managed-agents

Автор
  • Имя
    ElKornacio
    Telegram

Кратко

https://claude.com/blog/new-in-claude-managed-agentsAnthropic завезли "сны" для агентов в их облаке. этакая концепция само-рефлексии, где агент...

https://claude.com/blog/new-in-claude-managed-agents

Anthropic завезли "сны" для агентов в их облаке. этакая концепция само-рефлексии, где агент время от времени анализирует логи собственных сессий и прикидывает, где и что он мог бы сделать лучше, и какие новые скиллы/правила ему завести, чтобы стать ✨лучшей версией себя ✨ звучит конечно интересно, но учитывая регулярные проблемы моделей с овер-спецификациями (когда вместо выведения и редактирования общих паттернов они просто жестко зашивают себе в правила конкретные кейсы), не уверен, насколько хорошо оно сработает

вторая прикольная фича - outcomes. вы можете заранее сохранить "эталонный результат", набор требований, которые должны применяться к какому-то результату работы, и тогда, отдельная моделька (с отдельным контекстом) будет валидировать результат работы агента прежде чем он закончит работу. sounds cool, если бы не bias моделей в self-review задачках (даже с чистым контекстом). не думаю, что Anthropic будут юзать для grader другие foundational-модели. но несмотря на это, мне кажется, встраивание reality-check как обязательной части работы агента - это круто и полезно

14553 подписчика
472 поста