mirror of
https://github.com/chanzuckerberg/cellxgene.git
synced 2026-09-29 16:38:12 +08:00
Add provenance header to labels CSV file (#1041)
* add last mod time lookup to data locator * store data locator in Driver * save metadata header in labels csv * lint * fix tests * change datetime format to second precision
This commit is contained in:
@@ -37,7 +37,7 @@ class DataLoadEngineTest(unittest.TestCase):
|
||||
self.data._create_schema()
|
||||
|
||||
def test_delayed_load_data(self):
|
||||
self.data.update(data=self.data_file)
|
||||
self.data.update(data_locator=self.data_file)
|
||||
self.data._create_schema()
|
||||
self.assertEqual(self.data.cell_count, 2638)
|
||||
self.assertEqual(self.data.gene_count, 1838)
|
||||
@@ -45,7 +45,7 @@ class DataLoadEngineTest(unittest.TestCase):
|
||||
self.assertTrue(self.data.data.X[0, 0] - -0.171_469_51 < epsilon)
|
||||
|
||||
def test_diffexp_topN(self):
|
||||
self.data.update(data=self.data_file)
|
||||
self.data.update(data_locator=self.data_file)
|
||||
f1 = {"filter": {"obs": {"index": [[0, 500]]}}}
|
||||
f2 = {"filter": {"obs": {"index": [[500, 1000]]}}}
|
||||
result = json.loads(self.data.diffexp_topN(f1["filter"], f2["filter"]))
|
||||
|
||||
@@ -60,7 +60,7 @@ class WritableAnnotationTest(unittest.TestCase):
|
||||
res = self.data.annotation_put_fbs("obs", fbs)
|
||||
self.assertEqual(res, json.dumps({"status": "OK"}))
|
||||
self.assertTrue(path.exists(self.label_file))
|
||||
df = pd.read_csv(self.label_file, index_col=0)
|
||||
df = pd.read_csv(self.label_file, index_col=0, header=0, comment='#')
|
||||
self.assertEqual(df.shape, (n_rows, 2))
|
||||
self.assertEqual(set(df.columns), set(['cat_A', 'cat_B']))
|
||||
self.assertTrue(self.data.original_obs_index.equals(df.index))
|
||||
@@ -75,7 +75,7 @@ class WritableAnnotationTest(unittest.TestCase):
|
||||
res = self.data.annotation_put_fbs("obs", fbs)
|
||||
self.assertEqual(res, json.dumps({"status": "OK"}))
|
||||
self.assertTrue(path.exists(self.label_file))
|
||||
df = pd.read_csv(self.label_file, index_col=0)
|
||||
df = pd.read_csv(self.label_file, index_col=0, header=0, comment='#')
|
||||
self.assertEqual(set(df.columns), set(['cat_A', 'cat_C']))
|
||||
self.assertTrue(np.all(df['cat_A'] == ['label_A1' for l in range(0, n_rows)]))
|
||||
self.assertTrue(np.all(df['cat_C'] == ['label_C' for l in range(0, n_rows)]))
|
||||
|
||||
Reference in New Issue
Block a user