Method__init__(self, name, indexed_dataset, data_prefix,
num_epochs, max_num_samples, masked_lm_prob,
fengshen/data/megatron_dataloader/bert_dataset.py:32
Method__init__(self, name, indexed_dataset, data_prefix,
num_epochs, max_num_samples, masked_lm_prob,
fengshen/data/megatron_dataloader/bart_dataset.py:14
Method__init__(self, total_samples, consumed_samples, micro_batch_size,
data_parallel_rank, data_parallel_s
fengshen/data/universal_datamodule/universal_sampler.py:24
Method__init__(self, total_samples, consumed_samples, micro_batch_size,
data_parallel_rank, data_parallel_s
fengshen/data/universal_datamodule/universal_sampler.py:73
Method__init__(
self,
tokenizer,
collate_fn,
args,
datasets=None,
**kwargs,
fengshen/data/universal_datamodule/universal_datamodule.py:46
Method__init__(self, data_path=_SPLIT_DATA_PATH, num_worker=16, split_numb=600000, cut_sentence=True, output_file=None)
fengshen/data/bert_dataloader/preprocessing.py:63
Method__init__(self, tokenizer, max_length, mask_rate=0.15, max_ngram=3, if_padding=True)
fengshen/examples/pretrain_bert/pretrain_bert.py:38