aboutsummaryrefslogtreecommitdiffhomepage
diff options
context:
space:
mode:
authorStanislav Boboň2020-12-03 12:45:23 +0100
committerStanislav Boboň2020-12-03 12:45:23 +0100
commit135c3a61cff884bf7d2610ef33ef53caa6286483 (patch)
treefdb8cb9407047adb279bacff5e325ae37cddf630
parent69223f5070cb8fdfe585e2b5a073c9d39d14e48d (diff)
downloadsec-certs-135c3a61cff884bf7d2610ef33ef53caa6286483.tar.gz
sec-certs-135c3a61cff884bf7d2610ef33ef53caa6286483.tar.zst
sec-certs-135c3a61cff884bf7d2610ef33ef53caa6286483.zip
ugly import statements and short term goals
-rw-r--r--sec_certs/certificate.py14
-rw-r--r--sec_certs/dataset.py2
2 files changed, 8 insertions, 8 deletions
diff --git a/sec_certs/certificate.py b/sec_certs/certificate.py
index d58f59f4..5682fb58 100644
--- a/sec_certs/certificate.py
+++ b/sec_certs/certificate.py
@@ -12,7 +12,7 @@ from abc import ABC, abstractmethod
from bs4 import Tag, BeautifulSoup, NavigableString
from typing import Union, Optional, List, Dict, ClassVar, TypeVar, Type
-from sec_certs import helpers, extract_certificates
+from sec_certs import helpers, extract_certificates, dataset
from sec_certs.serialization import ComplexSerializableType, CustomJSONDecoder, CustomJSONEncoder
import sec_certs.constants as constants
@@ -243,7 +243,7 @@ class FIPSCertificate(Certificate, ComplexSerializableType):
html_items_found['fips_vendor'] = vendor_string
if html_items_found['fips_vendor'] == '':
- logger.warning(f"WARNING: NO VENDOR FOUND{current_file}")
+ logger.warning(f"WARNING: NO VENDOR FOUND {current_file}")
@staticmethod
def parse_lab(current_div: Tag, html_items_found: Dict, current_file: Path):
@@ -254,21 +254,19 @@ class FIPSCertificate(Certificate, ComplexSerializableType):
'div', 'panel-body').children)[2].strip().split('\n')[1].strip()
if html_items_found['fips_lab'] == '':
- logger.warning(f"WARNING: NO LAB FOUND{current_file}")
+ logger.warning(f"WARNING: NO LAB FOUND {current_file}")
if html_items_found['fips_nvlap_code'] == '':
- logger.warning(f"WARNING: NO NVLAP CODE FOUND{current_file}")
+ logger.warning(f"WARNING: NO NVLAP CODE FOUND {current_file}")
@staticmethod
def parse_related_files(current_div: Tag, html_items_found: Dict):
links = current_div.find_all('a')
# TODO: break out of circular imports hell
- html_items_found['fips_security_policy_www'] = __import__(
- 'sec_certs').certificate.FIPSCertificate.FIPS_BASE_URL + links[0].get('href')
+ html_items_found['fips_security_policy_www'] = dataset.FIPSDataset.FIPS_BASE_URL + links[0].get('href')
if len(links) == 2:
- html_items_found['fips_certificate_www'] = __import__(
- 'sec_certs').certificate.FIPSCertificate.FIPS_BASE_URL + links[1].get('href')
+ html_items_found['fips_certificate_www'] = dataset.FIPSDataset.FIPS_BASE_URL + links[1].get('href')
@classmethod
def html_from_file(cls, file: Path) -> 'FIPSCertificate':
diff --git a/sec_certs/dataset.py b/sec_certs/dataset.py
index 3f9a4f88..b35adf2f 100644
--- a/sec_certs/dataset.py
+++ b/sec_certs/dataset.py
@@ -518,6 +518,8 @@ class FIPSDataset(Dataset, ComplexSerializableType):
not_available.append(i)
return missing, not_available
+# TODO: make this work for single certs object instead of the whole dataset, making it parallelizable
+# TODO: make this not create a whole new json - that way continuous processing can be done
def extract_keywords(self):
self.fragments_dir.mkdir(parents=True, exist_ok=True)
if self.new_files > 0 or not (self.root_dir / 'fips_full_keywords.json').exists():