import json import gc import pandas as pd import numpy as np import pickle import tensorflow as tf import sys import progressbar from neighbor_genes import read_genome_maps from process_data import create_data_homology_ls from read_get_gene_seq import read_gene_sequences from access_data_rest import update_rest from threads import Procerssrunner from prepare_synteny_matrix import read_data_synteny from tree_data import create_tree_data from process_data import create_map_list def read_database(fname): df=pd.read_csv(fname,sep="\t",header=None) label_dict=dict(ortholog_one2one=1, other_paralog=0, non_homolog=2, ortholog_one2many=1, ortholog_many2many=1, within_species_paralog=0, gene_split=4) label=[] for _,row in df.iterrows(): label.append(label_dict[row[7]]) df=df.assign(label=label) df=df.drop(7,axis=1) df=df.drop(0,axis=1) df.columns=["gene_stable_id","species","homology_gene_stable_id","homology_species","goc","wga","label"] return df def select_data_by_length(df,st,end): try: if end