I have a list of urls like this :
'https://www.journaldunet.com/magazine/mentions-legales.shtml',
'https://www.lemonde.fr/big-browser/article',
'https://www.lemonde.fr/planete/index.html',
'https://www.lemonde.fr/les-decodeurs/live',
And I want to write a function that can return a url sliced based on a condition : if the end of the url is ending with article or html or php
so the desired result would be like this :
'https://www.journaldunet.com/magazine/,
'https://www.lemonde.fr/big-browser/,
'https://www.lemonde.fr/planete/,
'https://www.lemonde.fr/les-decodeurs/live',
You can try:
>>> a = "https://www.journaldunet.com/magazine/mentions-legales.shtml"
>>> a.rsplit('/', 1)
['https://www.journaldunet.com/magazine', 'mentions-legales.shtml']
On brief:
>>> url_list = ['https://www.journaldunet.com/magazine/mentions-legales.shtml',
... 'https://www.lemonde.fr/big-browser/article',
... 'https://www.lemonde.fr/planete/index.html',
... 'https://www.lemonde.fr/les-decodeurs/live']
>>> parse_list = []
>>> for single_url in url_list:
... parse_list.append(single_url.rsplit('/', 1)[0])
...
>>> print(parse_list)
['https://www.journaldunet.com/magazine', 'https://www.lemonde.fr/big-browser', 'https://www.lemonde.fr/planete', 'https://www.lemonde.fr/les-decodeurs']
If you love us? You can donate to us via Paypal or buy me a coffee so we can maintain and grow! Thank you!
Donate Us With