평화건설 포트폴리오 자동 수집기 만들기
중급45분2026-05-15
Python의 Requests와 BeautifulSoup 라이브러리를 활용해 기업 웹사이트의 HTML 코드를 분석하고 포트폴리오 데이터를 추출합니다. 수집한 이미지 주소와 상세 링크 정보가 담긴 'portfolio_list.csv' 파일을 생성하여 엑셀에서 즉시 활용 가능한 데이터셋을 만듭니다.
이 코칭은 터미널에서 진행됩니다
오른쪽 패널에서 설치 명령어를 복사하세요이런 걸 배워요
- requests 라이브러리를 사용해 웹페이지의 HTML 콘텐츠를 가져올 수 있습니다.
- BeautifulSoup을 이용해 HTML을 파싱하고 원하는 데이터를 추출할 수 있습니다.
- CSS 선택자를 사용하여 웹페이지의 특정 요소를 정확하게 찾아낼 수 있습니다.
- 추출한 데이터를 CSV 파일 형식으로 저장하여 관리할 수 있습니다.
어떻게 진행해요
1. 프로젝트 환경 설정 및 라이브러리 설치
2. 웹페이지 HTML 내용 가져오기
3. 가져온 HTML을 분석 가능한 형태로 변환하기
4. 포트폴리오 목록 전체 선택하기
5. 각 항목에서 이미지와 상세 링크 추출하기
6. 추출한 데이터를 CSV 파일로 저장하기
7. 최종 스크립트 실행 및 결과 확인
AI 튜터가 각 단계를 하나씩 안내해줄 거예요