跳至正文

看清 AI 真正的回答

LLM Scraper API 并不调用模型的 API。它采集真实用户在 ChatGPT、Gemini、Google AI Mode、Perplexity 或 Copilot 中看到的回答,来自特定国家、特定时刻,并附带界面所引用的来源。这正是官方 API 无法提供的数据。

  • 五大引擎:ChatGPT、Gemini、AI Mode、Perplexity、Copilot
  • 通过住宅网络实现国家级采集
  • 提取引用为带标题和 URL 的编号来源,而不是埋在正文里
  • 网络搜索可开可关,支持追问提示
  • 结构化 JSON:带 [n] 标记的回答文本及其引用
  • 在一个异步任务中批量运行数百条提示词
每次请求 100 个积分,任意引擎。采集失败不收费。无需银行卡即可开始。
支持 MCP一条命令即可连接你的智能体:npx -y @datafuel/mcp initClaudeOpenAI / ChatGPTGeminiCursorMistral
LLM Scraper · live capture
Queued
Capturing · US
JSON ready
Request
engineopenai
prompt"best CRM for startups"
websearchtrue
proxy_countryUS
What the user sees
CChatGPT· New York, US · 09:41
For an early-stage startup, HubSpot [1] and Pipedrive [2] are the most recommended; Attio if you want a data-first CRM…
g2.comhubspot.comtechradar.com
{
"text":"HubSpot [1], Pipedrive [2]…",
"citations":[
{ "n": 1, "title": "G2", … },
{ "n": 2, "title": "HubSpot", … },
{ "n": 3, "title": "TechRadar", … }
]
}
为什么重要

买家先问 AI。却没人告诉你它说了什么。

2.5B+ChatGPT 每天处理的查询量
~48%的 Google 搜索会显示 AI 概览
89%的 B2B 买家在采购时会咨询生成式 AI
37%的产品发现类查询如今始于 AI 界面
Google 给了你 Search Console

展示次数、点击、排名、查询词。二十年的工具积累,让你清楚自己的位置。

ChatGPT 什么都不给你

没有展示次数,没有控制台,无从得知它如何评价你。LLM Scraper API 就是那块缺失的控制台:按国家呈现回答、来源和变化。

一个请求搞定一切

该接口的能力,一目了然。
五大引擎openai、gemini、google_ai_mode、perplexity、copilot——一个参数即可切换。
地理定位proxy_country 从该国家的住宅出口运行查询。
引用提取界面中显示的来源以带标题和 URL 的编号引用返回。
追问提示follow_up_prompt 像真实用户一样延续同一段对话。
网络搜索开关websearch: true 允许引擎联网搜索;false 则只采集模型本身的回答。
时间点采集每次采集都是一个带有 processed_at 的任务,多次运行可按时间对齐。
结构化 JSON带 [n] 标记的回答文本及其对应的引用,统一为可预期的结构。
批量任务POST /job 搭配 prompts[],可异步运行数百条提示词。
各引擎能力每个界面向真实用户展示的内容,也就是你能获得的内容。
引擎
国家
引用
追问
网络搜索
ChatGPT
Perplexity
Gemini
Copilot
Google AI Mode

追问支持以当前版本为准;各引擎会在不另行通知的情况下增删界面功能,因此该矩阵与文档保持同步。

01 · 同一问题,不同答案

用户所在位置会改变答案

同一条提示词分别从米兰、纽约和新加坡提问,会得到三个明显不同的回答,推荐的品牌也不同。proxy_country 从该国家的住宅出口运行采集,让你看到当地用户所看到的一切。

地域会改变答案。任何官方 API 都无法向你展示这一点。

02 · 谁被引用

来源才是真正重要的信号

在回答逐字生成的同时,界面显示的每个引用都会成为一条带标题和 URL 的编号引用,并与正文中的 [n] 标记对应。你得到的是作为数据的引用,而不是需要从正文中解析的脚注。

引用频率在某个来源能否进入 AI 回答中的权重约为 35%。这正是值得追踪的指标。

03 · 随时间如何变化

模型更新会改写你的可见度

每周运行同一组提示词,你在回答中的位置就变成了一条时间序列。模型更新上线时,曲线会跳变,既无预告也无更新日志。持续监测是看到这一变化的唯一方式。

每次采集都带时间戳,因此变化是一个数据点,而不是一则轶事。

04 · 多引擎并行

一条提示词,五大引擎,一张表

同一条提示词分别发送到 ChatGPT、Perplexity、Gemini、Copilot 和 Google AI Mode,每个引擎一个请求。回答以相同的 JSON 结构返回,汇总成一张可比较的表格:谁被提及、谁被引用、出现在哪里。

五次调用,每个引擎一次,JSON 结构相同。

使用场景

团队用它衡量什么

AI 回答监测背后的真实工作,从品牌团队到服务他们的平台。

品牌可见度与声量份额

你出现的频率、相对竞争对手的排名,以及出现在哪些引擎上。

引用来源追踪

AI 在你所在品类中引用了哪些域名。这是 GEO 策略最直接的输入。

竞品对标

AI 如何描述和推荐竞争对手,与你相比如何。

情感倾向与准确性

AI 如何评价你,以及内容是否正确。对于金融、医疗和受监管行业,这就是有可验证记录的品牌治理。

内容缺口分析

在某个品类问题上竞争对手被推荐而你缺席,通常意味着存在内容缺口。

多市场监测

在美国、欧洲和亚太地区之间,你的定位如何随引擎而变化。

面向平台正在打造 GEO 工具?从这里开始。

GEO 平台是我们的客户,而不是竞争对手。带上你自己的逻辑,按次检查付费,无需自己运营五个浏览器集群。同一个 API,同样 100 积分的价格,内置批量处理和幂等性。

按次计价100 个积分
批量提示词POST /job · prompts[]
安全重试Idempotency-Key
阅读 API 参考
为什么不用官方 API

模型 API 回答的是你。界面回答的是你的客户。

业内人士最先提出的质疑,一张表说清楚。

官方模型 API
LLM Scraper API
你得到的内容
针对你的提示、来自数据中心的响应
真实用户在产品中看到的内容
地理位置
无
国家、州/省、城市
界面引用
通常缺失
提取为来源列表
网络搜索
取决于接口
可按请求控制
覆盖范围
一次只能用一家厂商
五大引擎,一次调用
价格

只为成功请求付费

选择月度套餐、一次性购买积分,或使用不限线程套餐。失败的请求永不计费。

每个套餐都包含所有端点和所有接口(API、MCP)。共用一个积分余额:你只为用量付费,而且只为成功的请求付费。

每月需要多少次请求?每月 10,000 LLM 采集
≈ 1,000,000 积分 · Growth
103K10K35K120K定制
Free

用真实积分测试每个端点。无需信用卡。

$0一次性试用
1,000 积分,一次性发放10 LLM 采集2 并发线程
  • 试用积分有效期 1 年
  • 所有端点,API + MCP
  • 社区支持
Growth最适合

适合需要充裕容量的生产级爬虫和智能体。

原价 $79,现价 $55.30 $79/ 月,按月计费
1,000,000 积分 / 月10,000 LLM 采集25 并发线程$5.53$7.90 每 1K 次采集
  • 包含 Starter 的全部功能
  • 自动充值
  • 优先聊天支持
Business

适合按计划交付数据产品的团队。

原价 $199,现价 $139.30 $199/ 月,按月计费
3,500,000 积分 / 月35,000 LLM 采集50 并发线程$3.98$5.69 每 1K 次采集
  • 包含 Growth 的全部功能
  • 按 API 密钥设置用量提醒
  • 客户经理
Scale

大用量,最低单页价格。即时开通。

原价 $499,现价 $349.30 $499/ 月,按月计费
12,000,000 积分 / 月120,000 LLM 采集150 并发线程$2.91$4.16 每 1K 次采集
  • 包含 Business 的全部功能
  • 专属 IP 池
  • 99.9% SLA
Enterprise

承诺用量、发票开具和治理管控。

定制
定制 积分 / 月250+ 并发线程
  • 定制用量定价
  • 定制并发数(250+)
  • SSO · 审计日志 · 数据处理协议
对比
FreeStarterGrowthBusinessScaleEnterprise
每月积分1K 一次性300K1M3.5M12M定制
并发线程2102550150250+
API 密钥131025无限制无限制
JS 渲染
住宅代理
AI 实时提取(使用你的密钥)
地理定位 · 195+ 个国家
批量多 URL
Unlocker · Crawl · Map · LLM Scraper
自动充值——
支持社区邮件优先聊天客户经理Slack + 电话专属支持 + SLA
一次请求实际花费多少?1 积分 = 1 个基础页面 · 费用不叠加:JS + 住宅代理为 20 积分,而不是 5 + 10
1×基础 HTTP简单 HTML,数据中心代理
5×JS 渲染用于动态网站的无头浏览器
10×住宅代理真实住宅 IP
20×JS + 住宅代理全力应对受保护网站
免费AI In-Flight任意 Unlocker 请求均可使用 LLM 提取(使用你自己的 AI 密钥),不额外消耗积分
FAQ

常见问题

引擎、定位与计费,直截了当地回答。

引擎与采集采集什么,从哪里采集。
支持哪些模型?
目前支持五个引擎:ChatGPT(openai)、Gemini(gemini)、Google AI Mode(google_ai_mode)、Perplexity(perplexity)和 Copilot(copilot)。每个请求通过 engine 参数选择其一;一个批量任务中的所有提示词使用同一个引擎。
地理定位如何工作?
设置 proxy_country(ISO 代码),采集就会从该国家的住宅出口运行,界面的表现与当地用户看到的一致:包括语言、来源和推荐内容。
每个模型都始终提供引用来源吗?
只要界面显示来源,就会提取引用。五个引擎都会展示来源;目前 ChatGPT 和 Perplexity 支持追问提示。上方的能力矩阵与文档保持同步。
与官方模型 API 有什么区别?
官方 API 针对你的提示返回来自数据中心的响应,没有地理位置,通常也没有界面中的引用,而且一次只能用一家厂商。LLM Scraper 则采集真实用户在产品中看到的内容,可指定国家、带上显示的来源,用同一个 API 覆盖五个引擎。
计费与用量一次请求的费用,以及可以多频繁地运行。
可以多频繁地查询?
只要在你的并发上限之内,想查多少次都可以。用于监测时,可将提示词批量放入 POST /job,并按你的计划(每小时、每天、每周)运行;每个任务都会记录处理时间,多次运行可串成时间序列。
究竟什么算作一次成功请求?
一次返回了回答内容的抓取。如果引擎封锁、超时或未返回可用内容,请求即为失败且不计费。无论使用哪个引擎、是否开启网络搜索,每次成功请求均为 100 个积分。
可以设置定时监测吗?
目前定时任务在你这一侧运行:从 cron 或工作流工具调用 POST /job,然后通过 GET /job/{id}/results 获取结果。使用 Idempotency-Key,确保重试的任务不会重复计费。
合规服务条款与数据处理。
使用 AI 服务商的产品是否涉及服务条款问题?
自动查询第三方 AI 助手会涉及其服务条款。我们只采集未登录用户可公开看到的内容,按引擎限速,并且在任务生命周期结束后绝不保留你的提示词。企业客户可通过客户团队索取我们的法律立场文件和 DPA。
立即开始

准备好开始构建了吗?

从免费套餐起步,随项目增长灵活扩展。 无需信用卡,无需销售电话。

直接与工程师沟通,而不是聊天机器人。