프로그래밍/Python

[웹크롤링] 파이썬으로 삼성주식뉴스 가져오기

Leeys 2020. 9. 20. 02:56

 

 

 

 

🛒 함께 보면 좋은 상품: 아오란 아웃도어 릴렉스 접이식 캠핑 의자, 블랙, 2개

https://link.coupang.com/a/fUd2CyZ8xw

 

아오란 아웃도어 릴렉스 접이식 캠핑 의자, 카키색, 2개 - 간이 의자 | 쿠팡

현재 별점 4.5점, 리뷰 1283개를 가진 아오란 아웃도어 릴렉스 접이식 캠핑 의자, 카키색, 2개! 지금 쿠팡에서 더 저렴하고 다양한 간이 의자 제품들을 확인해보세요.

www.coupang.com

이 포스팅은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.

In [1]:
import requests
from bs4 import BeautifulSoup
import pandas as pd

result = []
jour = []
for page in range(10):
    raw = requests.get('https://search.naver.com/search.naver?&where=news&query=%EC%82%BC%EC%84%B1%EC%A0%84%EC%9E%90' + str(page * 10 + 1), headers={'User-Agent': 'Mozilla/5.0'}).text
    html = BeautifulSoup(raw, 'html.parser')
    articles = html.select('.type01 > li')

    for article in articles:
        journal = article.select_one('span._sp_each_source').text
        title = article.select_one('a._sp_each_title').text
        result.append(title)
        jour.append(jour)

    print('다음페이지')
        
 
다음페이지
다음페이지
다음페이지
다음페이지
다음페이지
다음페이지
다음페이지
다음페이지
다음페이지
다음페이지
In [ ]:
a = pd.DataFrame({'title' : title, 'journal' : jour})
print(len(a))