API Crawl
Una chiamata percorre un intero sito e legge ogni pagina sotto l'URL di partenza, restituendole in Markdown pronto per LLM invece che in HTML grezzo. Il crawl segue i link in ampiezza, resta sul tuo sito e sotto il tuo percorso, e recupera ogni pagina con il motore Unlocker: i siti protetti non sono un caso speciale.
- Una chiamata, centinaia di pagine: crawl in ampiezza sotto l'URL di partenza, solo sullo stesso sito
- max_pages, max_depth e filtri di percorso RE2 tracciano il perimetro prima dell'avvio
- Markdown o JSON per ogni pagina, abbastanza pulito da usarlo così com'è per gli embedding
- Asincrono: 202 con un job_id, poi interroghi lo stato e scorri i risultati
- Deduplicato: una voce per pagina, qualunque sia il numero di link che vi puntano
- 1 credito per pagina con Basic, 5 con js_rendering; pagine fallite rimborsate
npx -y @datafuel/mcp initTutto in un solo job
Sei cose che fa l'endpoint, a colpo d'occhio.Da un URL a un corpus completo
Dai al crawl un URL di partenza e percorre ogni pagina sottostante, in ampiezza, restituendole una per una in Markdown pulito. Una chiamata, un dataset: nessun elenco di link da mantenere, nessuna richiesta per pagina da orchestrare.
Dati dimostrativi. I conteggi delle pagine sono indicativi; i crawl reali seguono i link del sito fino ai tuoi limiti.
Controlli che evitano sorprese
max_depth e max_pages tracciano il perimetro prima dell'avvio del crawl, e i pattern include/exclude lo restringono ulteriormente. Il job non mette mai in coda più pagine di quelle consentite, così il costo è limitato e prevedibile, non una fattura senza tetto.
Dati dimostrativi. Le stime usano i prezzi Basic, 1 credito per pagina; le pagine con js_rendering costano 5.
Pronto per pipeline RAG e AI
Ogni pagina torna come Markdown strutturato: titoli, elenchi e tabelle preservati, navigazione, script e boilerplate rimossi. Nessuna fase di post-elaborazione: dividi in chunk, crea gli embedding, recupera.
Dati dimostrativi. Chunking ed embedding avvengono nella tua pipeline; l'API restituisce il Markdown.
Asincrono su larga scala
Un crawl è un job, non una richiesta: ricevi subito un 202 e un job_id e il crawl gira sui nostri server. Il tuo codice non resta bloccato: interroghi GET /crawl/{job_id} per l'avanzamento e scorri i risultati mentre le pagine arrivano ancora.
Dati dimostrativi. job_id, tempi e conteggi delle pagine sono indicativi.
Paghi solo le richieste riuscite
Scegli un piano mensile, acquista crediti una tantum o usa thread illimitati. Le richieste fallite non vengono mai fatturate.
Ogni piano include tutti gli endpoint e tutte le interfacce (API, MCP). Un unico saldo di crediti condiviso: paghi solo il volume, e solo per le richieste riuscite.
Prova ogni endpoint con crediti reali. Nessuna carta richiesta.
- Crediti di prova validi 1 anno
- Tutti gli endpoint, API + MCP
- Supporto della community
Per crawler e agenti in produzione che hanno bisogno di margine.
- Tutto quello del piano Starter
- Ricarica automatica
- Supporto chat prioritario
Per team che rilasciano prodotti di dati a cadenza regolare.
- Tutto quello del piano Growth
- Avvisi di utilizzo per API key
- Account manager
Alto volume alla tariffa per pagina più bassa. Checkout immediato.
- Tutto quello del piano Business
- Pool di IP dedicato
- SLA 99.9%
Volume garantito, fatturazione e governance.
- Prezzi a volume su misura
- Concorrenza su misura (250+)
- SSO · audit log · DPA
| Free | Starter | Growth | Business | Scale | Enterprise | |
|---|---|---|---|---|---|---|
| Crediti / mese | 1K una tantum | 300K | 1M | 3,5M | 12M | Su misura |
| Thread simultanei | 2 | 10 | 25 | 50 | 150 | 250+ |
| API key | 1 | 3 | 10 | 25 | Illimitate | Illimitate |
| Rendering JS | ||||||
| Proxy residenziali | ||||||
| AI in-flight (con la tua chiave) | ||||||
| Geotargeting · 195+ paesi | ||||||
| Batch multi-URL | ||||||
| Unlocker · Crawl · Map · LLM Scraper | ||||||
| Ricarica automatica | — | — | ||||
| Supporto | Community | Chat prioritaria | Account manager | Slack + telefono | Dedicato + SLA |
Domande frequenti
Perimetro, risultati e fatturazione, con risposte dirette.
Come decide il crawl quali pagine visitare?
Un crawl è una singola chiamata o un job?
Cosa ricevo per ogni pagina?
Quando conviene usare Map al posto di Crawl?
Come viene fatturato un crawl?
Cosa succede alle pagine non riuscite?
I crediti scadono?
C'è un limite di concorrenza?
Pronto a costruire?
Parti dal piano gratuito e cresci insieme al tuo progetto. Nessuna carta di credito, nessuna call commerciale.
Parli con un ingegnere, non con un chatbot.