Содержание
Claude получил полноценный набор инструментов для работы с веб-страницами
Anthropic открыла Browser Use для Claude API. Новый инструмент позволяет AI-агенту переходить по сайтам, читать страницы, заполнять формы, нажимать кнопки и работать с несколькими вкладками. В набор входит 27 действий по умолчанию, а ещё четыре функции — выполнение JavaScript, загрузка файлов, чтение консоли и сетевых запросов — можно включить отдельно.
Claude видит не только скриншот
Главное отличие Browser Use от обычного управления компьютером — доступ к структуре страницы. Claude получает дерево доступности с ссылками на кнопки, поля и другие элементы, поэтому может обращаться к ним напрямую, а не угадывать координаты по изображению экрана. Скриншоты и работа по координатам при этом тоже поддерживаются.
Это должно сделать длинные браузерные сценарии стабильнее: например, поиск товара, заполнение анкеты, сбор информации из нескольких вкладок или работа с веб-сервисом. Инструмент также умеет запрашивать несколько последовательных действий за один ход модели, что снижает задержку и число API-вызовов.
Браузер запускает сам разработчик
Anthropic не предоставляет готовый облачный браузер для этой функции. Приложение должно самостоятельно запустить браузерную автоматизацию, выполнить команды Claude, сохранить сессию и вернуть результат модели. Browser Use доступен через Claude API и пока не работает внутри Claude Managed Agents, Amazon Bedrock, Google Cloud и Microsoft Foundry.
Почему это важно
Для бизнеса и разработчиков это новый фундамент для агентов, которые выполняют реальные задачи на сайтах: от внутренних панелей и CRM до исследований, поддержки и рутинных операций. Структурный доступ к элементам страницы может уменьшить количество ошибок по сравнению с автоматизацией, которая полагается только на изображения и движения мыши.
При этом ответственность за безопасность остаётся у создателя приложения. Anthropic рекомендует изолировать браузер, ограничивать доступ к данным и проверять опасные действия: содержимое веб-страниц может содержать prompt injection, а команды агента способны приводить к реальным изменениям.