Python을 이용하여 파일 다운로드하기
Python을 이용하여 파일 다운로드
가끔 파일을 다운로드 해야 할 때
이런식으로 되어 있어서 일일히 저 링크들을 누르고, 다운 받고 해야하는 경우가 있다.
일일히 누르고, 다운받고….너무 귀찮다!!!
어떻게 하는 거죠?
- 저 파일 링크들을 눌렀을 때 나오는 주소
쏼라쏼라/PDF-dir/ch1.pdf
앞 부분 주소까지 넣으면 너무 저 사이트를 공개하는 것 같아서 앞 부분 주소는 뺐다
- 혹은 검사(혹은 f12)를 눌렀을 때 확인 할 수 있는 주소
를 보면
파일에 따라 뒷 부분 만 바뀐다는 것을 알 수 있다.
ch1 파일이면 쏼라쏼라/PDF-dir/ch1 .pdf
ch2 파일이면 쏼라쏼라/PDF-dir/ch2 .pdf
….
ch123 파일이면 쏼라쏼라/PDF-dir/ch123 .pdf
그래서 주소 뒷 부분만 바꾸면 파일을 읽어오고 다운 받을 수 있겠구나 라는 걸 알 수 있었다.
그래서 파이썬으로 어떻게 하냐고요
note : 나는 google colaboratory 를 이용했다.
코드는 매우 간단하다.
1 2 3 4 5 6 7 8 | import urllib.request from google.colab import files for i in range(1,32): file_name = 'ch'+str(i)+'.pdf' url = 'https://www.db-book.com/db7/slides-dir/PDF-dir/ch'+str(i)+'.pdf' urllib.request.urlretrieve(url, file_name) files.download(file_name) | cs |
- range는 끝 값을 포함하지 않는 것을 주의하자.
- file name을 지정하는 부분에서 꼭 확장자 를 붙여 줘야 한다. 그래야 다운 후에 정상적으로 이용이 가능하다.
urlretrive로 url 변수의 값에 있는 주소로 가서 file_name에 저장해주고
file_name에 저장된 값을 다운로드 하면 된다.
위의 코드를 실행하고 나면
이렇게 다운로드가 진행되고, 다운로드 된 파일을 내 컴퓨터에서 사용 가능하게 된다!
참 쉽죠?
아직 배움의 과정에 있는 학생이니 내용에 부족한 점이 보이면 지적은 하되, 비난은 하지 말아주세요!!
댓글남기기