Python을 이용하여 파일 다운로드하기

최대 1 분 소요

Python을 이용하여 파일 다운로드

가끔 파일을 다운로드 해야 할 때

이런식으로 되어 있어서 일일히 저 링크들을 누르고, 다운 받고 해야하는 경우가 있다.

일일히 누르고, 다운받고….너무 귀찮다!!!

어떻게 하는 거죠?

  • 저 파일 링크들을 눌렀을 때 나오는 주소

쏼라쏼라/PDF-dir/ch1.pdf

앞 부분 주소까지 넣으면 너무 저 사이트를 공개하는 것 같아서 앞 부분 주소는 뺐다

  • 혹은 검사(혹은 f12)를 눌렀을 때 확인 할 수 있는 주소

​ 를 보면

파일에 따라 뒷 부분 만 바뀐다는 것을 알 수 있다.

ch1 파일이면 쏼라쏼라/PDF-dir/ch1 .pdf

ch2 파일이면 쏼라쏼라/PDF-dir/ch2 .pdf

….

ch123 파일이면 쏼라쏼라/PDF-dir/ch123 .pdf

그래서 주소 뒷 부분만 바꾸면 파일을 읽어오고 다운 받을 수 있겠구나 라는 걸 알 수 있었다.

그래서 파이썬으로 어떻게 하냐고요

note : 나는 google colaboratory 를 이용했다.

코드는 매우 간단하다.

1
2
3
4
5
6
7
8
import urllib.request
from google.colab import files
 
for i in range(1,32):
  file_name = 'ch'+str(i)+'.pdf'
  url = 'https://www.db-book.com/db7/slides-dir/PDF-dir/ch'+str(i)+'.pdf'
  urllib.request.urlretrieve(url, file_name)
  files.download(file_name)
cs
  • range는 끝 값을 포함하지 않는 것을 주의하자.
  • file name을 지정하는 부분에서 꼭 확장자 를 붙여 줘야 한다. 그래야 다운 후에 정상적으로 이용이 가능하다.

urlretrive로 url 변수의 값에 있는 주소로 가서 file_name에 저장해주고

file_name에 저장된 값을 다운로드 하면 된다.

위의 코드를 실행하고 나면

이렇게 다운로드가 진행되고, 다운로드 된 파일을 내 컴퓨터에서 사용 가능하게 된다!

참 쉽죠?







아직 배움의 과정에 있는 학생이니 내용에 부족한 점이 보이면 지적은 하되, 비난은 하지 말아주세요!!

댓글남기기