페이지 유형
Bright Data의 LinkedIn Scraper API는 프로필, 회사, 채용 공고, 게시물을 중심으로 구성되어 있습니다. Apify의 LinkedIn 액터 생태계도 프로필, 회사 데이터, 채용 공고로 비슷하게 구분됩니다. 이것이 올바른 접근 방식입니다. LinkedIn 페이지 유형마다 서로 다른 워크플로를 구축하세요.
공개 접근과 로그인 접근
LinkedIn 페이지는 브라우저에서 접근 가능한 것처럼 보여도 자동화할 때는 다르게 작동할 수 있습니다.- 공개 프로필 페이지는 로그인 없이 제한된 정보를 제공할 수 있습니다.
- 채용 공고 페이지는 유용한 필드를 공개하는 경우가 많습니다.
- 회사 페이지는 지역과 레이아웃에 따라 달라집니다.
- 검색과 인물 탐색은 훨씬 더 제한적이며 로그인을 요구하는 경우가 많습니다.
- 로그인 상태에서 스크래핑하면 계정이 위험해지고 플랫폼 규정을 위반할 수 있습니다.
채용 공고 스크래핑 워크플로
채용 공고는 공개적으로 검색되도록 만들어졌기 때문에 LinkedIn에서 가장 실용적인 스크래핑 대상인 경우가 많습니다. 다음 항목을 수집하세요.- 직무명
- 회사명
- 회사 URL
- 위치
- 채용 공고 URL
- 게시일
- 고용 형태
- 직급
- 직무 분야 또는 업종
- 설명
- 표시되는 경우 지원자 수
프로필 및 회사 워크플로
공개 프로필에서는 특별한 권한 없이 표시되는 필드만 수집하고 개인 데이터는 최소화하세요. 회사 페이지에서는 조직 수준 정보에 집중하세요.- 회사명
- 웹사이트
- 업종
- 본사
- 회사 규모 범위
- 설명
- 공개 페이지 URL
- 관련이 있는 경우 최근 공개 게시물
기술적 과제
LinkedIn 스크래핑은 다음 요소의 제약을 받습니다.- 로그인 메시지
- 속도 제한
- 동적 렌더링
- 검색 결과 제한
- 세션 및 핑거프린트 검사
- 페이지 유형별 레이아웃 차이
- 법률 및 계정 정책 위험