I am trying to build a scraper for Linkedin Jobs. I have been getting errors again and again because I am having difficulty in parsing links out of HTML files.
Here's the code I have written:
page_source=BeautifulSoup(driver.page_source,'lxml')
job_card = page_source.find_all('div', class_='base-card relative w-full hover:no-underline focus:no-underline base-card--link base-search-card base-search-card--link job-search-card')
for job in job_card:
job_title= job.find('h3',class_='base-search-card__title').text.replace(' ','')
job_company_name = job.find('h4',class_='base-search-card__subtitle').text.replace(' ','')
job_link_post = job.find('href',class_='base-card__full-link absolute top-0 right-0 bottom-0 left-0 p-0 z-[2]').text.replace(' ','')
print(f'Title = {job_title}\n'
f'Company Name = {job_company_name}\n'
f'Job Link = {job_link_post}\n')
I know I can't parse HTML with text, but I have tried several ways still I am getting this error. Any help will be appreciated. Thank you so much!
EDIT
Sharing a screenshot of the href class I am using: