>>> sk = pd.read_csv('sklearn-results.txt', delim_whitespace=True) >>> sk = sk.set_index('name') >>> ds = pd.read_csv('dsbox-results-all.txt', delim_whitespace=True) >>> ds = ds.set_index('name') >>> all = ds.join(sk, how='inner', lsuffix='_dsbox', rsuffix='_sklearn') >>> all.to_csv('join-results.csv') >>> mse = all.loc[j['metric']=='meanSquaredError'] >>> f1 = all.loc[j['metric']!='meanSquaredError'] >>> (f1['value_dsbox'] > f1['value_sklearn']).sum() 64 >>> (f1['value_dsbox'] == f1['value_sklearn']).sum() 8 >>> (f1['value_dsbox'] < f1['value_sklearn']).sum() 55 >>> (mse['value_dsbox'] < mse['value_sklearn']).sum() 22 >>> (mse['value_dsbox'] == mse['value_sklearn']).sum() 1 >>> (mse['value_dsbox'] > mse['value_sklearn']).sum() 35 >>> f1.shape (127, 3) >>> mse.shape (58, 3)