Una definizione chiara: leggere i dati da una pagina dopo che è stata visualizzata nella propria scheda del browser, senza un server o un'API di mezzo.
Schermata··7 minuti di lettura
Punti chiave
scraping tramite browser Legge i dati da una pagina dopo che è stata completamente caricata all'interno di una vera scheda del browser, lo stesso contenuto che vedi sullo schermo
Gestisce siti che fanno un uso intensivo di JavaScript, come Google Maps, che generano i loro contenuti dinamicamente, dove le semplici richieste al server restituiscono un guscio vuoto
Vonsel utilizza questo metodo tramite un'estensione gratuita di Chrome: cattura le aziende dalla mappa, quindi le spinge in un CRM mappato con recensioni e intelligenza artificiale per le email
Definizione
Cosa significa realmente lo scraping basato sul browser
scraping tramite browser è un metodo di raccolta dati che consiste nel leggere una pagina web dopo che è stata completamente renderizzata all'interno di una vera scheda del browser. Invece di richiedere dati strutturati a un server remoto, lo strumento ispeziona lo stesso contenuto che il browser ha visualizzato sullo schermo. Legge il contenuto in tempo reale Modello a oggetti del documento, l'albero di elementi che un browser crea a partire da HTML, CSS e JavaScript.
Questo è importante perché i siti moderni raramente inviano una pagina completa. Inviano un semplice scheletro HTML, che poi JavaScript riempie di contenuti dopo il caricamento. Una normale richiesta al server vede solo lo scheletro e nient'altro. Un browser vede la pagina completa, così come uno scraper che viene eseguito al suo interno. Il browser si occupa del difficile lavoro di rendering, mentre lo scraper si limita a leggere il risultato..
In pratica, lo scraping tramite browser viene solitamente eseguito come estensione di Chrome o come un piccolo script in un browser headless. La versione più comune è l'estensione, perché utilizza la sessione, i cookie e la vista già aperti. Non è necessario configurare server né gestire chiavi API.
Guarda come funziona lo scraping tramite browser
Aggiungi l'estensione Vonsel a Chrome, apri Google Maps e crea un elenco di attività commerciali direttamente dalla pagina visualizzata. Download gratuito. Nessun periodo di prova, nessuna carta di credito richiesta.
Dietro le quinte, uno scraper basato su browser segue un semplice ciclo. Non causa alcun danno e non nasconde il traffico: legge ciò che la pagina già mostra.
1. La pagina viene visualizzata. Quando si apre una ricerca su Google Maps, il browser esegue il codice JavaScript del sito per visualizzare i risultati, le schede e i dettagli.
2. Lo scraper legge il DOM. In esecuzione all'interno della scheda, attraversa l'albero degli elementi ed estrae i campi che riconosce: nomi, indirizzi, numeri di telefono, valutazioni e collegamenti. Per un elenco più completo, consultare la nostra nota su Spiegazione dei campi dati di Google Maps..
3. Struttura i dati. Il testo sparso sulla pagina viene trasformato in righe ordinate, un'azienda per ogni record, pronto per l'esportazione o per un CRM.
4. Consegna il risultato. Con Vonsel, l'elenco acquisito confluisce in una dashboard mappata anziché in un foglio di calcolo separato, rendendo i dati utilizzabili nel momento stesso in cui vengono acquisiti.
DOM
l'albero degli elementi renderizzato che lo scraper legge, non il codice HTML grezzo
0
Chiavi API o server backend necessari per eseguire un'acquisizione basata su browser
1 scheda
Tutto avviene all'interno della scheda di Chrome che hai già aperta
Confronto
Analisi tramite browser vs API vs scraping lato server
Esistono tre metodi comuni per raccogliere dati web, ognuno dei quali presenta vantaggi e svantaggi. La tabella seguente è un rapido riferimento che puoi citare.
Aspetto
Basato su browser
Estrazione di dati dalle API
Scraping lato server
Dove corre
La tua scheda del browser
Endpoint remoto
Uno script di backend
Rens JavaScript
SÌ
N / A
Spesso no
Richiede chiavi API
NO
Generalmente
A volte
Utilizza la tua sessione
SÌ
NO
NO
sforzo di configurazione
Basso
Mezzo
Alto
Ideale per
Siti dinamici, elenchi rapidi
Feed strutturati
Lavori di grandi lotti
Lo scraping delle API è pulito quando un provider espone un endpoint, come l' API di Google Places, ma paghi per chiamata e rimani entro i termini e le quote. Lo scraping lato server è scalabile per grandi quantità di lavoro batch, ma ha difficoltà con le pagine che si generano solo in un browser reale. Lo scraping basato su browser colma questa lacuna per le pagine dinamiche e legate alla sessione con una configurazione minima. Per una suddivisione più approfondita, leggi Estensione di Chrome vs. scraping API..
Il punto fondamentale dello scraping basato sul browser è la tempistica. Legge la pagina Dopo JavaScript termina l'esecuzione, quindi visualizza le stesse attività commerciali, valutazioni e numeri di telefono che vede un essere umano. Ecco perché è adatto a Google Maps, dove i risultati esistono solo dopo che la mappa li ha disegnati.
Perché è adatto a Google Maps
Lo strumento giusto per una mappa dinamica
Google Maps è un caso da manuale per questo metodo. I risultati si caricano scorrendo, i dettagli si espandono quando si fa clic e quasi nulla è presente nella prima risposta HTML. Un browser Estensione Chrome scraper attende che la pagina finisca e poi legge le carte finite. Se vuoi il concetto più ampio, vedi Che cos'è lo scraping di Google Maps..
Poiché l'estensione viene eseguita all'interno di Chrome, eredita anche le protezioni e il comportamento del browser stesso, motivo per cui script di contenuto sono il modo standard in cui le estensioni leggono i dati della pagina. Come con qualsiasi metodo di raccolta, leggi prima i termini della pagina: la nostra guida su se È legale estrarre dati da Google Maps copre gli aspetti pratici.
Trasforma una mappa renderizzata in un elenco di contatti
Vonsel legge le attività commerciali sullo schermo e crea un elenco chiaro e strutturato in pochi secondi. Download gratuito. Nessun periodo di prova, nessuna carta di credito richiesta.
Ecco la distinzione che conta. Lo scraping basato sul browser è il significa: È un modo intelligente per leggere una pagina dinamica. Tuttavia, l'obiettivo non è ottenere un elenco di nomi e numeri grezzi. Di per sé, un file CSV estratto tramite scraping è solo testo in attesa di essere elaborato.
IL FINE è quello che fai dopo. Vonsel considera la cattura come un punto di ingresso in un completo CRM mappato. Ogni attività commerciale viene visualizzata su una mappa, che puoi arricchire con recensioni pubbliche, utilizzare l'analisi delle recensioni per individuare i punti critici e generare email personalizzate tramite intelligenza artificiale per ogni singola attività, anziché inviare messaggi generici.
È inoltre possibile riaprire un'acquisizione precedente e aggiungere altre attività commerciali, allegare recensioni alle voci già salvate e tenere traccia di tutto ciò che è stato estratto. Questa è la differenza tra un semplice elenco e un database contestualizzato e a valore aggiunto che è effettivamente utilizzabile per le vendite.
Lo scraping basato su browser legge la pagina. Vonsel lo trasforma in un database su cui puoi agire
Riepilogo rapido
Il web scraping tramite browser in un paragrafo
Lo scraping basato su browser raccoglie dati leggendo una pagina dopo che è stata visualizzata in una vera scheda del browser, utilizzando lo stesso contenuto che vede l'utente. È particolarmente efficace su siti dinamici e ricchi di JavaScript come Google Maps, non richiede chiavi API o server e solitamente funziona come estensione di Chrome. È il metodo più rapido per passare da una mappa interattiva a un elenco completo, e con Vonsel questo elenco si trasforma in un CRM mappato con recensioni e informazioni sulle email integrate.
Inizia a catturare immagini direttamente dal tuo browser
Leggi la mappa, crea l'elenco, integralo in un CRM mappato. Download gratuito. Nessun periodo di prova, nessuna carta di credito richiesta. Esplora le funzionalità oppure sfogliare Guide ai database..
Lo scraping basato su browser è un metodo che legge i dati da una pagina web dopo che questa è stata completamente caricata all'interno di una scheda del browser. Invece di chiamare un server o un'API, lo strumento legge lo stesso contenuto renderizzato che è possibile visualizzare sullo schermo, quindi funziona con pagine dinamiche come Google Maps che generano i loro contenuti tramite JavaScript.
In che modo lo scraping tramite browser si differenzia dallo scraping tramite API?
Lo scraping tramite API richiede dati strutturati da un endpoint remoto e spesso necessita di chiavi, crediti e limiti di frequenza. Lo scraping basato su browser legge la pagina che il browser ha già visualizzato sul tuo computer, utilizzando la tua normale sessione. Gestisce pagine con un elevato utilizzo di JavaScript senza bisogno di un backend separato o di un contratto API.
L'estrazione dati tramite browser è una buona soluzione per Google Maps?
Sì. Google Maps genera i risultati dinamicamente nel browser, quindi un'estensione di Chrome basata sul browser può leggere nomi di attività commerciali, indirizzi, numeri di telefono e valutazioni direttamente dalla pagina visualizzata. Vonsel utilizza questo approccio per acquisire contatti e inviarli a un CRM mappato.