Python DataFormatter.get_expression_scikit_data_target_for_drugの例

プログラミング言語: Python

クラス/型: DataFormatter

メソッド/関数: get_expression_scikit_data_target_for_drug

hotexamples.comのコード掲載数: 5

Python DataFormatter.get_expression_scikit_data_target_for_drug - 5件のコード例が見つかりました。すべてオープンソースプロジェクトから抽出されたPythonのDataFormatter.get_expression_scikit_data_target_for_drug パッケージから commcare-hqの実例で、最も評価が高いものを厳選しています。コード例の評価を行っていただくことで、より質の高いコード例が表示されるようになります。

よく使われるメソッド

表示非表示

get_scikit_data_and_target(6)

get_expression_scikit_data_target_for_drug(5)

get_expression_frame_and_ic50_series_for_drug(4)

shuffle_scikit_data_target(4)

DataFormatter(3)

get_expression_frame_with_features(2)

formatData(2)

get_pval_top_n_features(2)

_format_array_v2(2)

get_normalized_full_expression_identifiers_and_data(2)

get_cell_line_expression_frame(2)

get_cell_line_and_patient_expression_data_target_for_drug(2)

make_recurrent(1)

remove_global_output_columns(1)

recurrent_regression_to_classification(1)

partition(1)

normalize_string(1)

normalize_expression_frame(1)

get_scikit_data(1)

get_alpha_vantage_data(1)

formatFile(1)

get_patients_expression_frame(1)

getFormattedData(1)

get_features_below_pval_threshold(1)

get_cell_line_and_patient_expression_data_target_top_features_for_drug(1)

get_cell_line_and_patient_expression_gene_intersection(1)

generate_distance_sums_for_individual_fish(1)

コード例 #1

ファイルを表示

ファイル: Classification.py プロジェクト: joewledger/Cell-Line-Classification

 def get_model_accuracy_filter_feature_size(self,expression_file, ic50_file,feature_size,num_permutations,drug):
     scikit_data,scikit_target = dfm.get_expression_scikit_data_target_for_drug(expression_file,ic50_file,drug,normalized=True,trimmed=True,threshold=None)
     for i in range(0,num_permutations):
         try:
             shuffled_data,shuffled_target = dfm.shuffle_scikit_data_target(scikit_data,scikit_target)
             accuracy = cv.cross_val_score_filter_feature_selection(self.model,cv.trim_X_num_features,feature_size,shuffled_data,shuffled_target,cv=5)
             yield accuracy.mean()
         except:
             yield 0.0

コード例 #2

ファイルを表示

ファイル: NEAT_Metrics.py プロジェクト: joewledger/Cell-Line-Classification

def get_accuracy_and_runtime_vs_num_generations(expression_file,ic50_file,num_features,generation_range,num_permutations,num_threads):
    drug = "SMAP"

    scikit_data,scikit_target = dfm.get_expression_scikit_data_target_for_drug(expression_file,ic50_file,drug,normalized=True,trimmed=True,threshold=None)
    p = Pool(num_threads)
    scores = p.map(wrap, [(g,scikit_data,scikit_target,num_features,num_permutations) for g in generation_range])
    scores = {g : scores[i] for i,g in enumerate(generation_range)}
    print(scores)
    return scores

コード例 #3

ファイルを表示

ファイル: Classification.py プロジェクト: joewledger/Cell-Line-Classification

    def get_model_accuracy_RFE(self,expression_file,ic50_file,target_features,num_permutations,drug):

        scikit_data,scikit_target = dfm.get_expression_scikit_data_target_for_drug(expression_file,ic50_file,drug,normalized=True,trimmed=True,threshold=None)
        step_length = int(len(scikit_data.tolist()[0]) / 100) + 1
        for i in xrange(0,num_permutations):
            try:
                shuffled_data,shuffled_target = dfm.shuffle_scikit_data_target(scikit_data,scikit_target)
                selector = RFE(self.model,target_features,step=step_length)
                yield cross_val_score(selector,shuffled_data,shuffled_target,cv=5).mean()
            except:
                yield 0.0

コード例 #4

ファイルを表示

ファイル: Classification.py プロジェクト: joewledger/Cell-Line-Classification

 def get_cross_validation_time(self,expression_file, ic50_file,feature_size,num_permutations,drug):
     scikit_data,scikit_target = dfm.get_expression_scikit_data_target_for_drug(expression_file,ic50_file,drug,normalized=True,trimmed=True,threshold=None)
     for i in range(0,num_permutations):
         try:
             shuffled_data,shuffled_target = dfm.shuffle_scikit_data_target(scikit_data,scikit_target)
             start_time = datetime.datetime.now()
             cv.cross_val_score_filter_feature_selection(self.model,cv.trim_X_num_features,feature_size,shuffled_data,shuffled_target,cv=5)
             end_time = datetime.datetime.now()
             yield float((end_time - start_time).microseconds) / 100000
         except:
             yield 0.0

コード例 #5

ファイルを表示

ファイル: Classification.py プロジェクト: joewledger/Cell-Line-Classification

    def get_predictions_full_CCLE_dataset_rfe(self,expression_file,ic50_file,target_features,drug):

        scikit_data,scikit_target = dfm.get_expression_scikit_data_target_for_drug(expression_file,ic50_file,drug,normalized=True,trimmed=True,threshold=None)
        step_length = int(len(scikit_data.tolist()[0]) / 100) + 1

        model = RFE(self.model,target_features,step=step_length)
        model.fit(scikit_data,scikit_target)

        expression_frame = dfm.normalize_expression_frame(dfm.get_cell_line_expression_frame(expression_file))
        cell_lines = expression_frame.columns
        testing_data = dfm.get_scikit_data(expression_frame)

        predictions = model.predict(testing_data)

        top_features = [expression_frame.index[i] for i in xrange(0,len(expression_frame.index)) if model.support_[i]]


        return cell_lines,predictions,top_features