想给 AI 知识库接入网页,通常第一步就会卡住:网站能打开,抓到的内容却夹着菜单、页脚,正文还缺了一截。Firecrawl 值得关注的地方,是它提供网页抓取和内容转换接口,让你有机会把精力放在后面的检索与问答上。[2]
它目前的免费方案每月有 1000 credits,不要求信用卡。[1] 如果是我第一次接入,会先拿这份额度判断自己的网页能不能变成好用的资料,暂时不急着选年付套餐。
先分清“一千额度”能做哪些事
| 使用方式 | 基础消耗 | 1000 credits 的单项算例 |
|---|---|---|
| 基础页面抓取 | 1 credit / 页 | 1000 页 |
| 基础搜索 | 每 10 条结果 2 credits | 500 组,每组 10 条结果 |
| 抓取并输出 JSON | 基础 1,加 JSON 4 / 页 | 200 页 |
表中是单项使用、未叠加其他收费功能的额度换算;搜索与抓取从同一份余额扣,不能把三行同时领取。免费档并发为 2。[1][2][3]
例如你先做 100 组搜索,每组返回 10 条基础结果、不附带正文抓取,会消耗 200 credits;剩下 800 可以留给基础抓取。若搜索时同时要求抓正文,或者增加结构化提取,预算就要另算。[1][3]
第一次,我会挑十个有代表性的页面
不要一开始就把整个站点交出去跑。挑几页长正文、带表格的页面,再放入一两页你以前觉得难抓的内容。十页只是建议的起步规模,并不是平台要求。
拿到结果后,我会逐页看三个地方:关键段落有没有少,标题与正文是否对应,表格里的数值还读不读得懂。随后问知识库几个只有原文才能回答的问题,看看答案能不能落回具体页面。
这一步比先追求“抓完一千页”更有价值。要是十页里的重要信息就缺失,扩大数量只会让后面整理更麻烦;如果这些页面表现符合预期,再逐渐扩范围,才知道额度花到了哪里。
抓不到想要的内容,也可能花额度
接口完成抓取,不代表拿到的是你要的正文。官方计费说明指出,实际返回的 403、404 页面也可能按一页消耗基础 credit;没有返回页面的失败请求则不收费。[1] 因而我会在试跑时同时检查目标网页状态和正文,避免把错误页一批批放进知识库。[2]
已经有明确的资料来源,先用免费档做一轮小样本就很合适。等你能说清楚每月需要多少页、是否需要 JSON、一次要并行多少任务,再看付费档更有把握。下面的方案入口可以查看当前额度;第一次的目标,不妨定成“让 AI 正确读懂这十页”。
资料核对与适用范围
2026-10-05 重读 Firecrawl 定价页及 Scrape、Search 官方文档,按当前基础计费规则作额度换算和小样本接入建议;未申请密钥、调用接口或测量页面成功率。
换算未叠加其他收费能力,搜索算例明确每组10条基础结果且不抓正文。免费并发和用量以当前方案为准;没有目标站抓取或知识库实测。JSON提取与目标错误页计费不应与基础页面额度混淆。