Firecrawl 团队宣布完成 A 轮融资($14.5M)并发布 /v2 版本
★ 性能与功能改进
1. 抓取速度提升 10 倍:智能缓存,常见页面几乎能在 1 秒内完成抓取。
2. 语义爬取:可以通过自然语言提示(例如“获取博客页面”)自动引导爬虫走向目标。
3. 搜索增强:支持新闻(news)和图片(images)搜索。
4. 自动摘要:新增 summary 格式,可直接获取网页的关键信息摘要,无需处理全文。
★ 开发者体验优化
1. 简化参数:API 参数更简单,默认启用合理选项(如广告屏蔽、跳过 TLS 校验、移除 Base64 图片)。
2. 更好的 SDK 支持:类型更完善,Python 支持改进。
3. 稳定性:无需手动处理超时,错误提示更清晰。
4. 可预览爬取参数:新增 /crawl-params-preview,可在运行前查看系统推导的参数。
★ 增强的数据获取方式
1. JSON 提取升级:使用 { type: "json", prompt, schema } 格式,旧的 "extract" 已更名为 "json"。
2. 截图增强:采用对象形式配置截图参数:{ type: "screenshot", fullPage, quality, viewport }。
★ 配套产品升级
1. 全新 Playground(即时测试端点)和 Dashboard(管理监控任务)。
2. 与 Fireplexity(类似 Perplexity 的应用) 集成,搜索时自动拉取相关图片。
整体来看,/v2 的重点是:更快、更智能、更好用,尤其是面向开发者体验的优化和面向语义搜索/爬取的突破。
项目:github.com/firecrawl/firecrawl
#人工智能##程序员# http://t.cn/AXvZdSqO
发布于 北京
