# Error while training with MONAILabel's deepedit

**URL:** <https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582>\
**Category:** Support\
**Tags:** segmentation, monailabel\
**Created:** [July 13, 2023, 12:34pm UTC](https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582 "2023-07-13T12:34:21Z")\
**Posts on this page:** 6\
**Page:** 1

<div class="post-metadata">

**Author:** ![lukasvanderstricht](https://avatars.discourse-cdn.com/v4/letter/l/7ba0ec/32.png) [@lukasvanderstricht](https://discourse.slicer.org/u/lukasvanderstricht)\
**Post date:** [July 13, 2023, 12:34pm UTC](https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582/1 "2023-07-13T12:34:22Z")

</div>

Dear all

I am currently using 3D Slicer and its MONAILabel extension to train a segmentation model using the DeepEdit model from the predefined radiology app. Both manual segmentation and training have been going smoothly up till now and the automatic segmentation functionality seems to be doing its job.  
However, when I want to further train the model at this point, without having added any new labels (so just starting the training process again), I always get one of the two following errors

1. Exit code -9

> [2023-07-13 08:52:08,765] [24408] [MainThread] [INFO] (monailabel.utils.sessions:51) - Session Path: /home/dellxpsazdelta/.cache/monailabel/sessions  
> [2023-07-13 08:52:08,765] [24408] [MainThread] [INFO] (monailabel.utils.sessions:52) - Session Expiry (max): 3600  
> [2023-07-13 08:52:08,765] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:353) - Train Request (input): {‘model’: ‘deepedit’, ‘name’: ‘train\_01’, ‘pretrained’: 1, ‘device’: ‘cuda’, ‘max\_epochs’: 50, ‘early\_stop\_patience’: -1, ‘val\_split’: 0.2, ‘train\_batch\_size’: 1, ‘val\_batch\_size’: 1, ‘multi\_gpu’: True, ‘gpus’: ‘all’, ‘dataset’: ‘CacheDataset’, ‘dataloader’: ‘ThreadDataLoader’, ‘client\_id’: ‘user-xyz’, ‘local\_rank’: 0}  
> [2023-07-13 08:52:08,766] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:363) - CUDA\_VISIBLE\_DEVICES: 0,1  
> [2023-07-13 08:52:08,767] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:368) - Distributed/Multi GPU is limited  
> [2023-07-13 08:52:08,767] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:381) - Distributed Training = FALSE  
> [2023-07-13 08:52:08,767] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:408) - 0 - Train Request (final): {‘name’: ‘train\_01’, ‘pretrained’: 1, ‘device’: ‘cuda’, ‘max\_epochs’: 50, ‘early\_stop\_patience’: -1, ‘val\_split’: 0.2, ‘train\_batch\_size’: 1, ‘val\_batch\_size’: 1, ‘multi\_gpu’: False, ‘gpus’: ‘all’, ‘dataset’: ‘CacheDataset’, ‘dataloader’: ‘ThreadDataLoader’, ‘model’: ‘deepedit’, ‘client\_id’: ‘user-xyz’, ‘local\_rank’: 0, ‘run\_id’: ‘20230713\_0852’}  
> [2023-07-13 08:52:08,768] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:504) - 0 - Using Device: cuda; IDX: None  
> [2023-07-13 08:52:08,768] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:331) - Total Records for Training: 5  
> [2023-07-13 08:52:08,768] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:332) - Total Records for Validation: 1  
> Loading dataset: 0%| | 0/1 [00:00\<?, ?it/s]  
> Loading dataset: 100%|██████████| 1/1 [00:10\<00:00, 10.10s/it]  
> Loading dataset: 100%|██████████| 1/1 [00:10\<00:00, 10.10s/it]  
> [2023-07-13 08:53:05,649] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:275) - 0 - Records for Validation: 1  
> [2023-07-13 08:53:05,748] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:265) - 0 - Adding Validation to run every ‘1’ interval  
> [2023-07-13 08:53:05,749] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:591) - 0 - Load Path /home/dellxpsazdelta/radiology\_psoas\_azd/model/deepedit\_dynunet/train\_01/model.pt  
> Loading dataset: 0%| | 0/5 [00:00\<?, ?it/s]  
> Loading dataset: 20%|██ | 1/5 [00:05\<00:20, 5.20s/it]  
> Loading dataset: 40%|████ | 2/5 [00:10\<00:15, 5.05s/it]  
> Loading dataset: 60%|██████ | 3/5 [00:13\<00:08, 4.37s/it]  
> Loading dataset: 80%|████████ | 4/5 [00:18\<00:04, 4.36s/it]  
> Loading dataset: 100%|██████████| 5/5 [00:23\<00:00, 4.62s/it]  
> Loading dataset: 100%|██████████| 5/5 [00:23\<00:00, 4.63s/it]  
> [2023-07-13 08:53:29,092] [24408] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:227) - 0 - Records for Training: 5  
> [2023-07-13 08:53:29,098] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:697) - Engine run resuming from iteration 0, epoch 0 until 50 epochs  
> [2023-07-13 08:53:30,700] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:138) - Restored all variables from /home/dellxpsazdelta/radiology\_psoas\_azd/model/deepedit\_dynunet/train\_01/model.pt  
> [2023-07-13 08:53:38,945] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 1/50, Iter: 1/5 – train\_loss: 0.8791  
> 2023-07-13 08:53:40,341 - INFO - Number of simulated clicks: 11  
> [2023-07-13 08:53:41,639] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 1/50, Iter: 2/5 – train\_loss: 0.8105  
> [2023-07-13 08:53:42,155] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 1/50, Iter: 3/5 – train\_loss: 0.8015  
> [2023-07-13 08:53:42,632] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 1/50, Iter: 4/5 – train\_loss: 0.8339  
> 2023-07-13 08:53:45,352 - INFO - Number of simulated clicks: 9  
> [2023-07-13 08:53:46,177] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 1/50, Iter: 5/5 – train\_loss: 0.8071  
> [2023-07-13 08:53:46,433] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:265) - Got new best metric of train\_dice: 0.678305447101593  
> [2023-07-13 08:53:46,434] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:85) - Current learning rate: 0.0001  
> [2023-07-13 08:53:46,434] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:199) - Epoch[1] Metrics – left psoas\_dice: 0.7228 right psoas\_dice: 0.6338 train\_dice: 0.6783  
> [2023-07-13 08:53:46,434] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:209) - Key metric: train\_dice best value: 0.678305447101593 at epoch: 1  
> [2023-07-13 08:53:46,435] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:697) - Engine run resuming from iteration 0, epoch 0 until 1 epochs  
> 2023-07-13 08:53:48,278 - INFO - Number of simulated clicks: 10  
> [2023-07-13 08:53:49,005] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:265) - Got new best metric of val\_mean\_dice: 0.6918515563011169  
> [2023-07-13 08:53:49,005] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:199) - Epoch[1] Metrics – left psoas\_dice: 0.7021 right psoas\_dice: 0.6816 val\_mean\_dice: 0.6919  
> [2023-07-13 08:53:49,005] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:209) - Key metric: val\_mean\_dice best value: 0.6918515563011169 at epoch: 1  
> [2023-07-13 08:53:51,338] [24408] [MainThread] [INFO] (monailabel.tasks.train.handler:86) - New Model published: /home/dellxpsazdelta/radiology\_psoas\_azd/model/deepedit\_dynunet/train\_01/model.pt =\> /home/dellxpsazdelta/radiology\_psoas\_azd/model/deepedit\_dynunet.pt  
> [2023-07-13 08:53:51,339] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:765) - Epoch[1] Complete. Time taken: 00:00:05  
> [2023-07-13 08:53:51,339] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:778) - Engine run complete. Time taken: 00:00:05  
> [2023-07-13 08:53:52,354] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:765) - Epoch[1] Complete. Time taken: 00:00:22  
> 2023-07-13 08:53:54,353 - INFO - Number of simulated clicks: 3  
> [2023-07-13 08:53:55,735] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 2/50, Iter: 1/5 – train\_loss: 0.7936  
> [2023-07-13 08:53:56,209] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 2/50, Iter: 2/5 – train\_loss: 0.8046  
> 2023-07-13 08:53:57,274 - INFO - Number of simulated clicks: 8  
> [2023-07-13 08:53:58,583] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 2/50, Iter: 3/5 – train\_loss: 0.7968  
> [2023-07-13 08:53:59,060] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 2/50, Iter: 4/5 – train\_loss: 0.8337  
> [2023-07-13 08:53:59,851] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:269) - Epoch: 2/50, Iter: 5/5 – train\_loss: 0.8011  
> [2023-07-13 08:53:59,853] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:265) - Got new best metric of train\_dice: 0.8020626306533813  
> [2023-07-13 08:53:59,853] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:85) - Current learning rate: 0.0001  
> [2023-07-13 08:53:59,853] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:199) - Epoch[2] Metrics – left psoas\_dice: 0.7723 right psoas\_dice: 0.8318 train\_dice: 0.8021  
> [2023-07-13 08:53:59,853] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:209) - Key metric: train\_dice best value: 0.8020626306533813 at epoch: 2  
> [2023-07-13 08:53:59,854] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:697) - Engine run resuming from iteration 0, epoch 1 until 2 epochs  
> 2023-07-13 08:54:01,733 - INFO - Number of simulated clicks: 9  
> [2023-07-13 08:54:02,684] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:265) - Got new best metric of val\_mean\_dice: 0.709175705909729  
> [2023-07-13 08:54:02,685] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:199) - Epoch[2] Metrics – left psoas\_dice: 0.7219 right psoas\_dice: 0.6965 val\_mean\_dice: 0.7092  
> [2023-07-13 08:54:02,685] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:209) - Key metric: val\_mean\_dice best value: 0.709175705909729 at epoch: 2  
> [2023-07-13 08:54:05,116] [24408] [MainThread] [INFO] (monailabel.tasks.train.handler:86) - New Model published: /home/dellxpsazdelta/radiology\_psoas\_azd/model/deepedit\_dynunet/train\_01/model.pt =\> /home/dellxpsazdelta/radiology\_psoas\_azd/model/deepedit\_dynunet.pt  
> [2023-07-13 08:54:05,116] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:765) - Epoch[2] Complete. Time taken: 00:00:05  
> [2023-07-13 08:54:05,116] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedEvaluator:778) - Engine run complete. Time taken: 00:00:05  
> [2023-07-13 08:54:05,418] [24408] [MainThread] [INFO] (ignite.engine.engine.SupervisedTrainer:765) - Epoch[2] Complete. Time taken: 00:00:13  
> [2023-07-13 08:54:14,842] [26118] [ThreadPoolExecutor-0\_0] [INFO] (monailabel.utils.async\_tasks.utils:76) - Return code: -9

1. Exit code 1

> [2023-07-13 12:20:04,630] [23149] [MainThread] [INFO] (monailabel.utils.async\_tasks.task:36) - Train request: {‘model’: ‘deepedit’, ‘name’: ‘train\_01’, ‘pretrained’: 1, ‘device’: ‘cuda’, ‘max\_epochs’: 50, ‘early\_stop\_patience’: -1, ‘val\_split’: 0.2, ‘train\_batch\_size’: 1, ‘val\_batch\_size’: 1, ‘multi\_gpu’: True, ‘gpus’: ‘all’, ‘dataset’: ‘CacheDataset’, ‘dataloader’: ‘ThreadDataLoader’, ‘client\_id’: ‘user-xyz’}  
> [2023-07-13 12:20:04,632] [23149] [ThreadPoolExecutor-0\_0] [INFO] (monailabel.utils.async\_tasks.utils:58) - COMMAND:: /opt/conda/bin/python -m monailabel.interfaces.utils.app -m train -r {“model”:“deepedit”,“name”:“train\_01”,“pretrained”:1,“device”:“cuda”,“max\_epochs”:50,“early\_stop\_patience”:-1,“val\_split”:0.2,“train\_batch\_size”:1,“val\_batch\_size”:1,“multi\_gpu”:true,“gpus”:“all”,“dataset”:“CacheDataset”,“dataloader”:“ThreadDataLoader”,“client\_id”:“user-xyz”}  
> [2023-07-13 12:20:05,144] [5998] [MainThread] [INFO] ( **main** :38) - Initializing App from: /home/dellxpsazdelta/radiology\_psoas\_azd; studies: /home/dellxpsazdelta/psoas-azd-images/train-images; conf: {‘models’: ‘deepedit’}  
> [2023-07-13 12:20:30,698] [5998] [MainThread] [INFO] (monailabel.utils.others.class\_utils:36) - Subclass for MONAILabelApp Found: \<class ‘main.MyApp’\>  
> [2023-07-13 12:20:30,748] [5998] [MainThread] [INFO] (monailabel.utils.others.class\_utils:36) - Subclass for TaskConfig Found: \<class ‘lib.configs.segmentation.Segmentation’\>  
> [2023-07-13 12:20:30,749] [5998] [MainThread] [INFO] (monailabel.utils.others.class\_utils:36) - Subclass for TaskConfig Found: \<class ‘lib.configs.deepgrow\_3d.Deepgrow3D’\>  
> [2023-07-13 12:20:30,770] [5998] [MainThread] [INFO] (monailabel.utils.others.class\_utils:36) - Subclass for TaskConfig Found: \<class ‘lib.configs.deepedit.DeepEdit’\>  
> [2023-07-13 12:20:30,771] [5998] [MainThread] [INFO] (monailabel.utils.others.class\_utils:36) - Subclass for TaskConfig Found: \<class ‘lib.configs.segmentation\_spleen.SegmentationSpleen’\>  
> [2023-07-13 12:20:30,772] [5998] [MainThread] [INFO] (monailabel.utils.others.class\_utils:36) - Subclass for TaskConfig Found: \<class ‘lib.configs.deepgrow\_2d.Deepgrow2D’\>  
> [2023-07-13 12:20:30,773] [5998] [MainThread] [INFO] (main:83) - +++ Adding Model: deepedit =\> lib.configs.deepedit.DeepEdit  
> [2023-07-13 12:20:32,241] [5998] [MainThread] [INFO] (lib.configs.deepedit:145) - EPISTEMIC Enabled: 0; Samples: 5  
> [2023-07-13 12:20:32,241] [5998] [MainThread] [INFO] (lib.configs.deepedit:149) - TTA Enabled: 0; Samples: 5  
> [2023-07-13 12:20:32,241] [5998] [MainThread] [INFO] (main:87) - +++ Using Models: [‘deepedit’]  
> [2023-07-13 12:20:32,241] [5998] [MainThread] [INFO] (monailabel.interfaces.app:126) - Init Datastore for: /home/dellxpsazdelta/psoas-azd-images/train-images  
> [2023-07-13 12:20:32,242] [5998] [MainThread] [INFO] (monailabel.datastore.local:125) - Auto Reload: False; Extensions: [‘_.nii.gz’, '_.nii’, ‘_.nrrd’, '_.jpg’, ‘_.png’, '_.tif’, ‘_.svs’, '_.xml’]  
> [2023-07-13 12:20:32,300] [5998] [MainThread] [INFO] (monailabel.datastore.local:540) - Invalidate count: 0  
> [2023-07-13 12:20:32,300] [5998] [MainThread] [INFO] (main:112) - +++ Adding Inferer:: deepedit =\> \<lib.infers.deepedit.DeepEdit object at 0x7f395c5280d0\>  
> [2023-07-13 12:20:32,300] [5998] [MainThread] [INFO] (main:112) - +++ Adding Inferer:: deepedit\_seg =\> \<lib.infers.deepedit.DeepEdit object at 0x7f395c12b990\>  
> [2023-07-13 12:20:32,301] [5998] [MainThread] [INFO] (main:161) - +++ Adding Trainer:: deepedit =\> \<lib.trainers.deepedit.DeepEdit object at 0x7f395c12b7d0\>  
> [2023-07-13 12:20:32,301] [5998] [MainThread] [INFO] (monailabel.utils.sessions:51) - Session Path: /home/dellxpsazdelta/.cache/monailabel/sessions  
> [2023-07-13 12:20:32,301] [5998] [MainThread] [INFO] (monailabel.utils.sessions:52) - Session Expiry (max): 3600  
> [2023-07-13 12:20:32,301] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:353) - Train Request (input): {‘model’: ‘deepedit’, ‘name’: ‘train\_01’, ‘pretrained’: 1, ‘device’: ‘cuda’, ‘max\_epochs’: 50, ‘early\_stop\_patience’: -1, ‘val\_split’: 0.2, ‘train\_batch\_size’: 1, ‘val\_batch\_size’: 1, ‘multi\_gpu’: True, ‘gpus’: ‘all’, ‘dataset’: ‘CacheDataset’, ‘dataloader’: ‘ThreadDataLoader’, ‘client\_id’: ‘user-xyz’, ‘local\_rank’: 0}  
> [2023-07-13 12:20:32,301] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:363) - CUDA\_VISIBLE\_DEVICES: None  
> [2023-07-13 12:20:32,302] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:368) - Distributed/Multi GPU is limited  
> [2023-07-13 12:20:32,302] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:381) - Distributed Training = FALSE  
> [2023-07-13 12:20:32,302] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:408) - 0 - Train Request (final): {‘name’: ‘train\_01’, ‘pretrained’: 1, ‘device’: ‘cuda’, ‘max\_epochs’: 50, ‘early\_stop\_patience’: -1, ‘val\_split’: 0.2, ‘train\_batch\_size’: 1, ‘val\_batch\_size’: 1, ‘multi\_gpu’: False, ‘gpus’: ‘all’, ‘dataset’: ‘CacheDataset’, ‘dataloader’: ‘ThreadDataLoader’, ‘model’: ‘deepedit’, ‘client\_id’: ‘user-xyz’, ‘local\_rank’: 0, ‘run\_id’: ‘20230713\_1220’}  
> [2023-07-13 12:20:32,302] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:504) - 0 - Using Device: cuda; IDX: None  
> [2023-07-13 12:20:32,303] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:331) - Total Records for Training: 7  
> [2023-07-13 12:20:32,303] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:332) - Total Records for Validation: 2  
> Loading dataset: 0%| | 0/2 [00:00\<?, ?it/s]  
> Loading dataset: 50%|█████ | 1/2 [00:09\<00:09, 9.83s/it]  
> Loading dataset: 100%|██████████| 2/2 [00:13\<00:00, 6.29s/it]  
> Loading dataset: 100%|██████████| 2/2 [00:13\<00:00, 6.82s/it]  
> [2023-07-13 12:21:44,249] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:275) - 0 - Records for Validation: 2  
> [2023-07-13 12:21:44,258] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:265) - 0 - Adding Validation to run every ‘1’ interval  
> [2023-07-13 12:21:44,258] [5998] [MainThread] [INFO] (monailabel.tasks.train.basic\_train:591) - 0 - Load Path /home/dellxpsazdelta/radiology\_psoas\_azd/model/deepedit\_dynunet/train\_01/model.pt  
> Loading dataset: 0%| | 0/7 [00:00\<?, ?it/s]  
> Loading dataset: 14%|█▍ | 1/7 [00:04\<00:25, 4.25s/it]  
> Loading dataset: 29%|██▊ | 2/7 [00:08\<00:21, 4.35s/it]  
> Loading dataset: 43%|████▎ | 3/7 [00:12\<00:16, 4.16s/it]  
> Loading dataset: 57%|█████▋ | 4/7 [00:16\<00:11, 3.93s/it]  
> Loading dataset: 71%|███████▏ | 5/7 [00:25\<00:11, 5.88s/it]  
> Loading dataset: 71%|███████▏ | 5/7 [00:29\<00:11, 5.87s/it]  
> Traceback (most recent call last):  
> File “/opt/conda/lib/python3.7/site-packages/monai/transforms/transform.py”, line 89, in apply\_transform  
> return \_apply\_transform(transform, data, unpack\_items)  
> File “/opt/conda/lib/python3.7/site-packages/monai/transforms/transform.py”, line 53, in \_apply\_transform  
> return transform(parameters)  
> File “/opt/conda/lib/python3.7/site-packages/monai/apps/deepedit/transforms.py”, line 99, in **call**  
> label = np.zeros(d[key].shape)  
> numpy.core.\_exceptions.MemoryError: Unable to allocate 502. MiB for an array with shape (512, 512, 251) and data type float64  
> The above exception was the direct cause of the following exception:  
> Traceback (most recent call last):  
> File “/opt/conda/lib/python3.7/runpy.py”, line 193, in \_run\_module\_as\_main  
> “ **main** ”, mod\_spec)  
> File “/opt/conda/lib/python3.7/runpy.py”, line 85, in \_run\_code  
> exec(code, run\_globals)  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/interfaces/utils/app.py”, line 132, in   
> run\_main()  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/interfaces/utils/app.py”, line 117, in run\_main  
> result = a.train(request)  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/interfaces/app.py”, line 380, in train  
> result = task(request, self.datastore())  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/tasks/train/basic\_train.py”, line 382, in **call**  
> res = self.train(0, world\_size, req, datalist)  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/tasks/train/basic\_train.py”, line 428, in train  
> context.trainer = self.\_create\_trainer(context)  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/tasks/train/basic\_train.py”, line 575, in \_create\_trainer  
> train\_data\_loader=self.train\_data\_loader(context),  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/tasks/train/basic\_train.py”, line 226, in train\_data\_loader  
> dataset, datalist = self.\_dataset(context, context.train\_datalist)  
> File “/opt/conda/lib/python3.7/site-packages/monailabel/tasks/train/basic\_train.py”, line 200, in \_dataset  
> if context.dataset\_type == “CacheDataset”  
> File “/opt/conda/lib/python3.7/site-packages/monai/data/dataset.py”, line 723, in **init**  
> self.set\_data(data)  
> File “/opt/conda/lib/python3.7/site-packages/monai/data/dataset.py”, line 748, in set\_data  
> self.\_cache = \_compute\_cache()  
> File “/opt/conda/lib/python3.7/site-packages/monai/data/dataset.py”, line 737, in \_compute\_cache  
> return self.\_fill\_cache()  
> File “/opt/conda/lib/python3.7/site-packages/monai/data/dataset.py”, line 761, in \_fill\_cache  
> desc=“Loading dataset”,  
> File “/opt/conda/lib/python3.7/site-packages/tqdm/std.py”, line 1195, in **iter**  
> for obj in iterable:  
> File “/opt/conda/lib/python3.7/multiprocessing/pool.py”, line 748, in next  
> raise value  
> File “/opt/conda/lib/python3.7/multiprocessing/pool.py”, line 121, in worker  
> result = (True, func(\*args, \*\*kwds))  
> File “/opt/conda/lib/python3.7/site-packages/monai/data/dataset.py”, line 777, in \_load\_cache\_item  
> item = apply\_transform(\_xform, item)  
> File “/opt/conda/lib/python3.7/site-packages/monai/transforms/transform.py”, line 113, in apply\_transform  
> raise RuntimeError(f"applying transform {transform}") from e  
> RuntimeError: applying transform \<monai.apps.deepedit.transforms.NormalizeLabelsInDatasetd object at 0x7f393a2fdfd0\>  
> [2023-07-13 12:22:24,359] [23149] [ThreadPoolExecutor-0\_0] [INFO] (monailabel.utils.async\_tasks.utils:76) - Return code: 1

It seems weird to me that without changing anything (such as adding new labels), the training suddenly starts to systematically fail while it was working fine before.  
Does anyone have any clue as to why these errors occur?

Thanks in advance!

---

<div class="post-metadata">

**Author:** ![rbumm](https://sea2.discourse-cdn.com/flex002/user_avatar/discourse.slicer.org/rbumm/32/9404_2.png) [@rbumm](https://discourse.slicer.org/u/rbumm)\
**Post date:** [July 14, 2023, 6:36am UTC](https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582/2 "2023-07-14T06:36:20Z")

</div>

It is probably better to open an issue on [MonaiLabel Github](https://github.com/Project-MONAI/MONAILabel) or maybe @diazandr3s can comment.

---

<div class="post-metadata">

**Author:** ![lukasvanderstricht](https://avatars.discourse-cdn.com/v4/letter/l/7ba0ec/32.png) [@lukasvanderstricht](https://discourse.slicer.org/u/lukasvanderstricht)\
**Post date:** [July 14, 2023, 6:46am UTC](https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582/3 "2023-07-14T06:46:24Z")

</div>

Okay, I will open an issue there, thank you!

---

<div class="post-metadata">

**Author:** ![diazandr3s](https://sea2.discourse-cdn.com/flex002/user_avatar/discourse.slicer.org/diazandr3s/32/9973_2.png) [@diazandr3s](https://discourse.slicer.org/u/diazandr3s)\
**Post date:** [July 14, 2023, 9:07am UTC](https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582/4 "2023-07-14T09:07:23Z")

</div>

Many thanks for the ping, @rbumm.  
I will comment on the issue opened by @lukasvanderstricht in the MONAI Label repo: [Error while training with MONAILabel's deepedit · Issue #1489 · Project-MONAI/MONAILabel · GitHub](https://github.com/Project-MONAI/MONAILabel/issues/1489)

---

<div class="post-metadata">

**Author:** ![rbumm](https://sea2.discourse-cdn.com/flex002/user_avatar/discourse.slicer.org/rbumm/32/9404_2.png) [@rbumm](https://discourse.slicer.org/u/rbumm)\
**Post date:** [July 14, 2023, 10:56am UTC](https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582/5 "2023-07-14T10:56:01Z")

</div>

Would be great @lukasvanderstricht if you could in the end add a short comment here if you were able to solve the problem - and how.

---

<div class="post-metadata">

**Author:** ![lukasvanderstricht](https://avatars.discourse-cdn.com/v4/letter/l/7ba0ec/32.png) [@lukasvanderstricht](https://discourse.slicer.org/u/lukasvanderstricht)\
**Post date:** [July 14, 2023, 11:05am UTC](https://discourse.slicer.org/t/error-while-training-with-monailabels-deepedit/30582/6 "2023-07-14T11:05:34Z")

</div>

This problem can be solved by switching from CacheDataset to Dataset in the Slicer MONAILabel GUI. This however entails that the training process will go slower. For the full discussion, I refer to [Error while training with MONAILabel's deepedit · Issue #1489 · Project-MONAI/MONAILabel · GitHub](https://github.com/Project-MONAI/MONAILabel/issues/1489).
