Rona

평화건설 포트폴리오 자동 수집기 만들기

중급452026-05-15

Python의 Requests와 BeautifulSoup 라이브러리를 활용해 기업 웹사이트의 HTML 코드를 분석하고 포트폴리오 데이터를 추출합니다. 수집한 이미지 주소와 상세 링크 정보가 담긴 'portfolio_list.csv' 파일을 생성하여 엑셀에서 즉시 활용 가능한 데이터셋을 만듭니다.

이 실습은 터미널에서 진행됩니다

이런 걸 배워요

  • requests 라이브러리를 사용해 웹페이지의 HTML 콘텐츠를 가져올 수 있습니다.
  • BeautifulSoup을 이용해 HTML을 파싱하고 원하는 데이터를 추출할 수 있습니다.
  • CSS 선택자를 사용하여 웹페이지의 특정 요소를 정확하게 찾아낼 수 있습니다.
  • 추출한 데이터를 CSV 파일 형식으로 저장하여 관리할 수 있습니다.

어떻게 진행해요

1. 프로젝트 환경 설정 및 라이브러리 설치
2. 웹페이지 HTML 내용 가져오기
3. 가져온 HTML을 분석 가능한 형태로 변환하기
4. 포트폴리오 목록 전체 선택하기
5. 각 항목에서 이미지와 상세 링크 추출하기
6. 추출한 데이터를 CSV 파일로 저장하기
7. 최종 스크립트 실행 및 결과 확인

AI 튜터가 각 단계를 하나씩 안내해줄 거예요