Tipi di pagina
L’API LinkedIn Scraper di Bright Data è organizzata intorno a profili, aziende, offerte di lavoro e post. L’ecosistema di attori LinkedIn di Apify è suddiviso in modo simile tra profili, dati aziendali e offerte. È il modello mentale corretto: crea flussi di lavoro diversi per i diversi tipi di pagina LinkedIn.
Accesso pubblico e accesso autenticato
Le pagine LinkedIn possono sembrare accessibili in un browser, ma comportarsi diversamente con l’automazione.- Le pagine dei profili pubblici possono mostrare informazioni limitate senza accesso.
- Le pagine delle offerte di lavoro spesso espongono pubblicamente campi utili.
- Le pagine aziendali variano in base a regione e layout.
- La ricerca e la scoperta delle persone sono molto più limitate e spesso spingono gli utenti ad accedere.
- Lo scraping da autenticati può mettere a rischio gli account e violare le regole della piattaforma.
Flusso di scraping delle offerte di lavoro
Le offerte sono spesso la destinazione LinkedIn più pratica, perché sono concepite per essere trovate pubblicamente. Raccogli:- Titolo della posizione
- Nome dell’azienda
- URL dell’azienda
- Località
- URL dell’offerta
- Data di pubblicazione
- Tipo di impiego
- Livello di anzianità
- Funzione o settore
- Descrizione
- Numero di candidati, se visibile
Flussi per profili e aziende
Per i profili pubblici, raccogli soltanto i campi visibili senza autorizzazioni speciali e riduci al minimo i dati personali. Per le pagine aziendali, concentrati sulle informazioni a livello di organizzazione:- Nome dell’azienda
- Sito web
- Settore
- Sede centrale
- Fascia di dimensioni dell’azienda
- Descrizione
- URL della pagina pubblica
- Post pubblici recenti, se pertinenti
Sfide tecniche
Lo scraping di LinkedIn è limitato da:- Richieste di accesso
- Limiti di frequenza
- Rendering dinamico
- Limiti dei risultati di ricerca
- Controlli della sessione e del fingerprint
- Variazioni di layout per tipo di pagina
- Rischi legali e relativi alle politiche degli account