GitHub-радар

Firecrawl: чистые данные из интернета для ИИ-агента

Открытый сервис команды Firecrawl превращает любую страницу в чистый текст или таблицу для ИИ-агента — разбираю, где он экономит фаундеру время и токены.

01firecrawl/firecrawl 180kTypeScript

Firecrawl — открытый сервис команды Firecrawl для работы с данными из интернета, есть и облачная версия. Он ищет в сети, открывает страницы и отдаёт их чистым текстом, готовой таблицей в формате JSON или скриншотом, а не сырым кодом страницы. По словам команды, он справляется с 96% сайтов, включая те, что собираются в браузере на ходу, и сам разбирается с прокси и ограничениями по частоте запросов. Перед сбором умеет нажать кнопку, пролистать и ввести текст, читает PDF и DOCX и подключается к ИИ-агентам как инструмент через MCP.

Зачем это вайб-кодеру

Я вижу здесь экономию сразу в двух местах. Чистый текст вместо кода страницы — это меньше токенов в каждом запросе агента, и команда сама делает на этом акцент. А работа, которую фаундеры обычно отдают фрилансеру, — собрать цены конкурентов, список компаний, данные рынка для питча — превращается в задачу агенту одной фразой. Похожий инструмент легко собрать под себя: агент каждое утро проверяет нужные страницы и присылает, что изменилось.

Как поставить

Скопируйте и отправьте своему агенту — Claude Code, Codex, любому:

Подключи Firecrawl к моему агенту как MCP-инструмент: https://github.com/firecrawl/firecrawl — действуй по README, спроси у меня ключ или разверни открытую версию, потом собери со страниц трёх моих конкурентов тарифы и цены в одну таблицу.

Облачная версия работает без установки по ключу; открытую версию агент развернёт у вас сам, мощный компьютер не нужен.

Открыть на GitHub