diff --git a/theHarvester/parsers/myparser.py b/theHarvester/parsers/myparser.py index b2fa519d..8a52f774 100644 --- a/theHarvester/parsers/myparser.py +++ b/theHarvester/parsers/myparser.py @@ -13,13 +13,13 @@ class Parser: .replace('%2f', '').replace('%3a', '').replace('', '').replace('', '')\ .replace('', '').replace('', '') - for e in ('<', '>', ':', '=', ';', '&', '%3A', '%3D', '%3C', '/', '\\'): - self.results = self.results.replace(e, ' ') + for search in ('<', '>', ':', '=', ';', '&', '%3A', '%3D', '%3C', '/', '\\'): + self.results = self.results.replace(search, ' ') def urlClean(self): self.results = self.results.replace('', '').replace('', '').replace('%2f', '').replace('%3a', '') - for e in ('<', '>', ':', '=', ';', '&', '%3A', '%3D', '%3C'): - self.results = self.results.replace(e, ' ') + for search in ('<', '>', ':', '=', ';', '&', '%3A', '%3D', '%3C'): + self.results = self.results.replace(search, ' ') def emails(self): self.genericClean() @@ -38,11 +38,11 @@ class Parser: reg_urls = re.compile('[a-zA-Z0-9._ ]* - Google\+') self.temp = reg_people.findall(self.results) resul = [] - for x in self.temp: - y = x.replace(' | LinkedIn', '') - y = y.replace(' profiles ', '') - y = y.replace('LinkedIn', '') - y = y.replace('"', '') - y = y.replace('>', '') - if y != " ": - resul.append(y) + for iteration in self.temp: + delete = iteration.replace(' | LinkedIn', '') + delete = delete.replace(' profiles ', '') + delete = delete.replace('LinkedIn', '') + delete = delete.replace('"', '') + delete = delete.replace('>', '') + if delete != " ": + resul.append(delete) return resul def hostnames_all(self): reg_hosts = re.compile('(.*?)') temp = reg_hosts.findall(self.results) - for x in temp: - if x.count(':'): - res = x.split(':')[1].split('/')[2] + for iteration in temp: + if iteration.count(':'): + res = iteration.split(':')[1].split('/')[2] else: - res = x.split('/')[0] + res = iteration.split('/')[0] self.temp.append(res) hostnames = self.unique() return hostnames @@ -96,14 +96,14 @@ class Parser: reg_people = re.compile(r'">[a-zA-Z0-9._ -]* \| LinkedIn') self.temp = reg_people.findall(self.results) resul = [] - for x in (self.temp): - y = x.replace(' | LinkedIn', '') - y = y.replace(' profiles ', '') - y = y.replace('LinkedIn', '') - y = y.replace('"', '') - y = y.replace('>', '') - if y != " ": - resul.append(y) + for iteration in (self.temp): + delete = iteration.replace(' | LinkedIn', '') + delete = delete.replace(' profiles ', '') + delete = delete.replace('LinkedIn', '') + delete = delete.replace('"', '') + delete = delete.replace('>', '') + if delete != " ": + resul.append(delete) return resul def people_twitter(self): @@ -111,36 +111,36 @@ class Parser: self.temp = reg_people.findall(self.results) users = self.unique() resul = [] - for x in users: - y = x.replace(' | LinkedIn', '') - y = y.replace(' profiles ', '') - y = y.replace('LinkedIn', '') - y = y.replace('"', '') - y = y.replace('>', '') - if y != " ": - resul.append(y) + for iteration in users: + delete = iteration.replace(' | LinkedIn', '') + delete = delete.replace(' profiles ', '') + delete = delete.replace('LinkedIn', '') + delete = delete.replace('"', '') + delete = delete.replace('>', '') + if delete != " ": + resul.append(delete) return resul def profiles(self): reg_people = re.compile(r'">[a-zA-Z0-9._ -]* - Google Profile') self.temp = reg_people.findall(self.results) resul = [] - for x in self.temp: - y = x.replace(' Google Profile', '') - y = y.replace('-', '') - y = y.replace('">', '') - if y != " ": - resul.append(y) + for iteration in self.temp: + delete = iteration.replace(' Google Profile', '') + delete = delete.replace('-', '') + delete = delete.replace('">', '') + if delete != " ": + resul.append(delete) return resul def set(self): reg_sets = re.compile(r'>[a-zA-Z0-9]*') self.temp = reg_sets.findall(self.results) sets = [] - for x in self.temp: - y = x.replace('>', '') - y = y.replace('', '') + delete = delete.replace(' list: self.new = [] - for x in self.temp: - if x not in self.new: - self.new.append(x) + for iteration in self.temp: + if iteration not in self.new: + self.new.append(iteration) return self.new