#!/usr/bin/python # -*- coding: UTF-8 -*- import sys _char_array_1 = set() _char_array_1 = set() _char_array_1 = set() char_file_1 = '../dict/universal_char_list_1_3500.txt' char_file_2 = '../dict/universal_char_list_2_3000.txt' char_file_3 = '../dict/universal_char_list_3_1605.txt' _target_exclude_file = sys.argv[1] with open(char_file_1, 'r', encoding='utf-8-sig') as f: for word in f.read().splitlines(): _char_array_1 = word print(len(_char_array_1)) with open(char_file_2, 'r', encoding='utf-8-sig') as f: for word in f.read().splitlines(): _char_array_2 = word print(len(_char_array_2)) with open(char_file_3, 'r', encoding='utf-8-sig') as f: for word in f.read().splitlines(): _char_array_3 = word print(len(_char_array_3)) exclude_char_list_level1= '' with open(_target_exclude_file, 'r', encoding='utf-8-sig') as f: for word in f.read().splitlines(): exclude_char_list_level1 = exclude_char_list_level1+word print(len(exclude_char_list_level1)) _level1_len = len(exclude_char_list_level1) def check_word_not_include (char): not_include = True try: if exclude_char_list_level1.index(char) > -1: return False except ValueError as err: not_include = True return not_include _char_array_remain_1 = '' _char_array_remain_2 = '' _char_array_remain_3 = '' for char in _char_array_1: if check_word_not_include(char): _char_array_remain_1 =_char_array_remain_1 +char print(len(_char_array_remain_1)) print(_char_array_remain_1)