Редагувати 09/2016: У Python 3 і новіших версіях використовуйте urllib.request замість urllib2
Насправді найпростіший спосіб:
import urllib2 # the lib that handles the url stuff
data = urllib2.urlopen(target_url) # it's a file like object and works just like a file
for line in data: # files are iterable
print line
Вам навіть не потрібні "читальні лінії", як запропонував Вілл. Ви можете навіть скоротити його до: *
import urllib2
for line in urllib2.urlopen(target_url):
print line
Але пам’ятайте в Python, читання має значення.
Однак це найпростіший спосіб, але не безпечний спосіб, оскільки більшість часу за допомогою мережевого програмування ви не знаєте, чи буде дотримано кількість очікуваних даних. Таким чином, вам зазвичай краще прочитати фіксовану та розумну кількість даних, чогось, на вашу думку, вистачить для очікуваних вами даних, але запобігти затопленню вашого сценарію:
import urllib2
data = urllib2.urlopen("http://www.google.com").read(20000) # read only 20 000 chars
data = data.split("\n") # then split it into lines
for line in data:
print line
* Другий приклад в Python 3:
import urllib.request # the lib that handles the url stuff
for line in urllib.request.urlopen(target_url):
print(line.decode('utf-8')) #utf-8 or iso8859-1 or whatever the page encoding scheme is