Web fetch, web search, browser: базовый стек инструментов AI-агента
Практическая модель выбора инструментов для агента: когда достаточно search/fetch и когда нужна browser-эскалация.
Понятные границы между search, fetch и browser
Снижение стоимости и latency через правильный порядок вызовов
Production-паттерн Search -> Fetch -> Browser
Самая частая ошибка в агентных проектах - сразу использовать browser для любой web-задачи. Это дорого, медленно и хрупко. В большинстве случаев правильный порядок такой: сначала поиск источников, затем извлечение контента, и только потом интерактивный браузер при необходимости.
Что делает каждый инструмент
web search: находит релевантные страницы по запросу, когда точный URL неизвестен.web fetch: читает конкретную страницу и возвращает очищенный контент.browser: выполняет действия на сайте как пользователь (клик, ввод, логин, JS-интерфейсы).
Правило выбора
- Нужно найти источники ->
web search. - URL уже есть и нужно прочитать страницу ->
web fetch. - Нужен интерактивный шаг или контент появляется только после действий ->
browser.
Production-пайплайн
- Search: собрать короткий список кандидатов (3-7 ссылок).
- Fetch: извлечь контент и убрать шум (навигация, футер, служебные блоки).
- Validate: проверить формат, полноту и релевантность.
- Escalate: если не хватает данных, перейти в browser-режим.
- Trace: сохранить шаги, ошибки, стоимость и latency.
Guardrails для каждого уровня
- Search guardrails:
- лимит количества результатов,
- приоритет доверенных доменов,
- запрет нерелевантных verticals.
- Fetch guardrails:
- таймаут,
- лимит размера ответа,
- проверка mime-type.
- Browser guardrails:
- allowlist доменов,
- denylist операций,
- human-in-the-loop для критичных действий.
Какие метрики смотреть
- Success rate по каждому инструменту (
search,fetch,browser). - Доля сценариев, где хватило
search+fetchбез browser-эскалации. - p95 latency и cost/session.
- Частота ошибок browser-шага (selectors, auth, anti-bot, timeout).
Антипаттерны
- Всегда запускать browser вместо fetch.
- Доверять первому результату search без проверки первоисточника.
- Не логировать шаги инструментов и причину выбора пути.
- Смешивать read-only и action инструменты без разделения политик.
Быстрый итог
Стабильный агент начинается не с “самой умной модели”, а с правильного tool routing. Если route между web search, web fetch и browser описан явно, качество ответа растет, а стоимость и время выполнения контролируются.