Firecrawl — API для поиска, сбора и обработки веб-данных. Он возвращает чистый Markdown, структурированный JSON, релевантные выдержки или ответ на вопрос, а также умеет обходить сайты, разбирать документы, управлять браузерными сессиями и отслеживать изменения.

📌
Актуальность: сведения сверены по официальной документации, changelog и странице тарифов Firecrawl по состоянию на 10 сентября 2026 года. Команды в этом редакторском проходе не запускались, поэтому проверка ниже описывает воспроизводимые признаки успеха, а не результат в конкретном аккаунте. Цены, лимиты и состав API сверяйте по ссылкам в конце материала.

Что это такое

Firecrawl принимает URL, файл или поисковый запрос и возвращает данные, подготовленные для языковой модели. Сервис рендерит JavaScript, использует прокси и средства обхода антибот-защиты, работает с динамическими страницами и поддерживает браузерные сессии.

Проект с открытым исходным кодом доступен в репозитории firecrawl/firecrawl. Облачный API работает по адресу https://api.firecrawl.dev; актуальная документация и эндпоинты используют версию v2.

Ключевые обновления 2026 года

ДатаЧто появилось
20 августаDeveloper Index для кодовых агентов: поиск по более чем 70 млн артефактов, включая README, внешнюю документацию, issues, pull requests и OpenAPI-спецификации. Доступен через API /search/developer, CLI, MCP и SDK
13 августаВ Research Index добавлена категория Life Sciences с 41 млн+ научных работ. Все категории Research Index стали бесплатными
22 июляОбновлённый /search начал возвращать наиболее релевантные выдержки. Firecrawl сообщает о результате 94,7% на SimpleQA и примерно в 10 раз меньшем числе токенов по сравнению с обработкой полных страниц; это собственные измерения компании
1 июляВеб-масштабный /monitor: наблюдение за всем вебом по поисковым запросам и сформулированной цели
24 июня, v2.11.0Research Index по 3 млн+ работ arXiv и связанным артефактам GitHub, доступ без ключа для /scrape, /search, /interact и /parse через официальные MCP-, CLI- и SDK-клиенты, redactPII, формат deterministicJson и поиск видео на страницах
26 мая/monitor для отслеживания изменений страниц и доставки уведомлений по вебхуку или электронной почте
15 мая, v2.10/parse, Lockdown Mode, форматы question и highlights, официальные SDK для Go, Ruby, PHP и .NET
10 апреля, v2.9.0/interact, режимы разбора PDF fast, auto и ocr, параметр onlyCleanContent, SDK для Java и Elixir

Эндпоинты и индексы

ЭндпоинтЧто делаетКогда нужен
/scrapeПреобразует одну страницу в Markdown, HTML, JSON, скриншот, выдержки или ответ на вопросПолучение содержимого конкретной страницы
/crawlОбходит сайт с фильтрами путей и собирает содержимое страницДокументация, база знаний, каталог
/mapВозвращает список URL сайтаРазведка структуры перед обходом
/searchИщет в вебе и может возвращать содержимое найденных страницСвежие внешние данные для агента
/parseРазбирает файлы до 50 МБ: PDF, DOCX, DOC, ODT, RTF, XLSX, XLS и HTMLПодготовка документов для систем с дополнением ответов данными (RAG) и извлечения данных
/agentАвтономно собирает веб-данные по задаче на естественном языкеИсследования и сложное извлечение без ручной схемы обхода
/interactПродолжает работу со страницей: нажимает кнопки, заполняет формы, выполняет код и переходит между страницамиЛогин, пагинация и динамические интерфейсы
/monitorЗапускает регулярные проверки страниц или веба и сообщает об измененияхМониторинг цен, релизов и документации
/search/researchИщет научные работы, позволяет читать их полный текст и находить связанные публикацииИсследования в AI/ML и Life Sciences
/search/developerИщет фрагменты в документации и артефактах публичных репозиториевВопросы о коде, API, ошибках и известных проблемах

Форматы, которые сокращают контекст

  • markdown — очищенный текст страницы и базовый формат для большинства задач.
  • json — структурированный результат.
  • deterministicJson — переиспользуемый экстрактор, который кешируется для сайта и делает повторное извлечение более согласованным и дешёвым.
  • question — ответ на вопрос, обоснованный содержимым одной страницы.
  • highlights — совпавшие с запросом предложения, строки кода и таблиц с сохранением исходного форматирования.
  • video — найденные видео с URL, заголовком, превью, длительностью и другими метаданными.

По данным Firecrawl, форматы question и highlights могут требовать до 100 раз меньше токенов по сравнению с передачей полной страницы. Фактическая экономия зависит от документа и запроса.


Подключение к API

Для прямых API-вызовов с повышенными лимитами создайте API-ключ в дашборде и передавайте его в заголовке Authorization. Храните ключ в переменной окружения.

export FIRECRAWL_API_KEY="fc-ваш-ключ"
curl -X POST "https://api.firecrawl.dev/v2/scrape" -H "Authorization: Bearer $FIRECRAWL_API_KEY" -H "Content-Type: application/json" -d '{"url":"https://example.com","formats":["markdown"]}'
import os
from firecrawl import Firecrawl

firecrawl = Firecrawl(api_key=os.environ["FIRECRAWL_API_KEY"])
doc = firecrawl.scrape("https://example.com", formats=["markdown"])

print(doc)
import { Firecrawl } from 'firecrawl'

const firecrawl = new Firecrawl({
  apiKey: process.env.FIRECRAWL_API_KEY
})

const doc = await firecrawl.scrape('https://example.com', {
  formats: ['markdown']
})

console.log(doc)

Официальные SDK доступны для Python, Node.js, Go, Rust, Java, Elixir, Ruby, PHP и .NET.

Доступ без API-ключа

Страница Introduction показывает первый запрос к /scrape и пример /search без ключа; API-ключ добавляют для более высоких лимитов. В релизе v2.11.0 также заявлен доступ к /scrape, /search, /interact и /parse без ключа через официальные MCP-, CLI- и SDK-клиенты.

Для автоматизированного режима без интерактивного входа документация рекомендует API-ключ. Бесплатный план с аккаунтом предоставляет 1 000 кредитов в месяц.

Подключение Firecrawl к Codex

В официальной инструкции для Codex CLI основной вариант — размещённый MCP (Model Context Protocol, протокол подключения инструментов) с OAuth:

codex mcp add firecrawl --url https://mcp.firecrawl.dev/v2/mcp-oauth
codex mcp login firecrawl

После входа запустите новую сессию Codex, выполните /mcp и убедитесь, что подключение firecrawl активно.

Если нужен CLI и скиллы для поддерживаемых кодовых агентов, Firecrawl предлагает установку одной командой:

npx -y firecrawl-cli@latest init --all --browser

После установки перезапустите агент. Скилл для Research Index устанавливается отдельно:

npx skills add firecrawl/skills@firecrawl-research-index
⚖️
MCP или CLI-скиллы. MCP подключает инструменты к сессии Codex. Команда CLI устанавливает CLI и скиллы для обнаруженных кодовых агентов. Выбор зависит от способа интеграции, который поддерживает ваш агент.

Проверка результата

Минимальная проверка — запрос /scrape из примера выше.

  1. Код из диапазона 2xx означает успешный запрос. В полном ответе cURL должен появиться объект data с запрошенным содержимым; SDK обычно возвращает его содержимое напрямую.
  2. Код 401 указывает на проблему с авторизацией. Для OAuth-подключения повторите codex mcp login firecrawl; для API-ключа проверьте переменную окружения.
  3. Код 429 означает превышение лимита запросов или конкурентности тарифа.
  4. В учёте использования должен отразиться расход кредитов. Базовый /scrape стоит один кредит за страницу.

Если используете MCP в Codex, дополнительно попросите агента найти свежие примечания к выпуску или собрать заголовки документации и проверьте, что ответ содержит ссылки на источники.


Тарифы, лимиты и кредиты

Цены ниже проверены 10 сентября 2026 года. Страница тарифов указывает, что эти цены действуют с 4 сентября 2026 года и приведены за месяц при годовой оплате.

ПланЦенаКредиты в месяцПараллельные браузеры
Free$01 0002
Hobby$16 / мес5 0005
Standard$83 / мес100 00025
Growth$333 / мес500 00050
Scale$599 / мес1 000 000100
EnterpriseПо договоруИндивидуальноИндивидуально

Hobby при помесячной оплате стоит $19. Для остальных планов перед покупкой проверяйте текущую помесячную цену на официальной странице.

Расход кредитов

  • /scrape, /crawl и /map — 1 кредит за страницу;
  • /monitor — 1 кредит за страницу при каждой проверке;
  • /search — 2 кредита за 10 результатов;
  • /interact — 2 кредита за минуту работы браузера;
  • /agent — 5 бесплатных запусков в день в период предварительного доступа, затем применяется динамическая цена;
  • форматы JSON, Question и Highlight в /scrape и /crawl добавляют 4 кредита за страницу;
  • детерминированное извлечение в /monitor тарифицируется по фиксированной ставке 7 кредитов за страницу за проверку.

Дополнительные кредиты и перенос остатков

На платных планах работает оплата по мере расходования (pay-as-you-go): когда баланс заканчивается, Firecrawl добавляет кредиты шагами по $5. Пользователь задаёт месячный предел расходов или отключает пополнение.

Один шаг даёт:

  • Hobby — 1 000 кредитов;
  • Standard — 2 000;
  • Growth — 2 500;
  • Scale — 5 000.

Купленные дополнительные кредиты сохраняются до использования, но сгорают при отмене подписки. Плановые кредиты Hobby, Standard и Growth на следующий период не переносятся. Scale переносит остаток на один месяц, а для Enterprise действуют индивидуальные условия.

⚖️
Нюанс биллинга: скрапинг, который не вернул результата, не тарифицируется. Страница, ответившая ошибкой вроде 403 или 404, всё равно возвращается и стоит один кредит.

Безопасность и приватность

  • Lockdown Mode. Параметр lockdown: true в /scrape разрешает отдавать данные только из индекса Firecrawl. Исходящие запросы, включая обращения к HTTP и robots.txt, блокируются; URL не сохраняется, а данные задания удаляются после доставки. Режим доступен через API, SDK, CLI и MCP.
  • Удаление персональных данных. Опция redactPII убирает из результата имена, адреса, телефоны, электронную почту и секреты.
  • Zero Data Retention. Для Enterprise и одобренных корпоративных сценариев Firecrawl предлагает обработку без хранения полученного содержимого.
  • Защита формата question. Содержимое страницы изолируется XML-разметкой и экранированием с помощью символов нулевой ширины, а модель получает указание игнорировать инструкции внутри страницы.
⚠️
Скачанный текст остаётся недоверенными данными. Встроенная защита снижает риск промпт-инъекции, но не даёт агенту права выполнять команды, найденные на странице, или раскрывать секреты.

Ограничения и когда сервис не подходит

  • Перед сбором данных с крупных социальных сетей и сайтов за логином проверьте доступность источника, его условия использования и наличие официального API.
  • Браузерные сессии тарифицируются по времени. Для статичных страниц дешевле использовать обычный /scrape.
  • Форматы JSON, Question и Highlight требуют дополнительных кредитов. Включайте их, когда сокращение последующей обработки оправдывает цену.
  • /agent остаётся в предварительном доступе с динамической стоимостью. Для предсказуемого производственного процесса удобнее фиксированная схема извлечения.
  • Плановые кредиты большинства самостоятельных тарифов не переносятся, поэтому нерегулярные массовые обходы требуют расчёта заранее.
  • Firecrawl не отменяет требования robots.txt, условия сайтов и правила обработки персональных данных. Юридическая оценка остаётся на стороне пользователя.

Полезные сценарии

Задача и входные данныеЧто сделатьПроверяемый результат и ограничение
Ответить по свежей документации по известному запросуВыполнить /search, затем для выбранной страницы вызвать /scrape с форматом highlights или questionВ ответе есть релевантные фрагменты и ссылки. Заявления производителя о точности не заменяют проверку первоисточника
Собрать RAG-базу по документации сайтаПолучить структуру через /map, ограничить нужные пути и запустить /crawl с MarkdownНа выходе есть документы по ожидаемым URL. Перед большим обходом проверьте лимиты, дубли и стоимость
Следить за ценами, релизами или изменениями документацииСоздать /monitor для страниц либо веб-поиска, задать расписание и доставку по вебхуку или почтеКонтрольное изменение появляется в списке проверок и доставляется выбранным каналом. Каждая проверенная страница расходует кредиты
Разобрать договоры, счета или отчёты размером до 50 МБПередать файл в /parse; для документов с персональными данными включить redactPIIПолучен Markdown или JSON с сохранёнными таблицами и порядком чтения. Для чувствительных данных отдельно проверьте договорные условия хранения
Регулярно извлекать одну структуру с одного сайтаОписать схему и использовать deterministicJsonПовторные запросы возвращают согласованную структуру. Изменение вёрстки источника всё равно требует контроля качества
Получить данные из динамического интерфейсаСначала выполнить /scrape, затем продолжить сессию через /interact и при необходимости использовать сохранённый профильВ ответе есть требуемые данные, а сессию можно наблюдать через режим просмотра (live view). Используйте браузер только для шагов, которые нельзя выполнить обычным запросом
Найти ответ о библиотеке или ошибке в кодеЧерез API выполнить поиск в Developer Index и сузить результаты по типу артефакта или репозиториюРезультат содержит устойчивый идентификатор, URL и совпавшие фрагменты из документации или репозитория. Фильтры этого уровня доступны в API; для CLI и MCP сверяйте фактический набор возможностей
Найти научную работу и проверить утверждениеИспользовать Research Index: сначала поиск, затем чтение подходящей работы или подбор связанных публикацийПолучены ссылки на работы и текст для проверки утверждения. Оценка качества исследования остаётся отдельной задачей

Для кого это полезно

Firecrawl подходит командам, которым нужно:

  • давать агентам доступ к актуальным веб-источникам;
  • строить RAG-системы по внешней документации;
  • собирать конкурентную аналитику и следить за изменениями;
  • превращать документы в Markdown или структурированные данные;
  • искать научную и техническую литературу;
  • использовать управляемые браузеры без собственной инфраструктуры прокси и headless-браузеров.

Ссылки


Следующий шаг

Выбор способа подключения и тарифа зависит от источников, частоты сбора и дальнейшей обработки данных. Такой разбор полезен командам, которые строят агентов и хотят контролировать качество и стоимость веб-контекста.

Если захотите обсудить, как это применить у себя или в команде — пишите в Telegram @pimenov