Index A | B | C | D | E | F | G | H | I | J | K | L | M | N | O | P | R | S | T | U | V | W | X | Y | Z A abbr_ends (micm_nlp.tokenizers.ka_sen_tok.KaSenTok attribute) abbreviations (micm_nlp.tokenizers.ka_sen_tok.KaSenTok attribute) adapt_to_lm (micm_nlp.config.TokenizerConfig attribute) adapter (micm_nlp.config.PretrainedConfig attribute) AdapterConfig (class in micm_nlp.config) add_post_processor() (in module micm_nlp.tokenizers.tokenizer) add_prefix_to_metrics() (in module micm_nlp.evals.eval) add_special_tokens() (in module micm_nlp.tokenizers.tokenizer) additional() (micm_nlp.enums.BertTokenSE class method) (micm_nlp.enums.ElectraTokenSE class method) (micm_nlp.enums.RobertaTokenSE class method) (micm_nlp.enums.T5TokenSE class method) (micm_nlp.enums.XLMRobertaTokenSE class method) (micm_nlp.enums.XLNetTokenSE class method) after_training (micm_nlp.config.EvalConfig attribute) after_training_on_test (micm_nlp.config.EvalConfig attribute) algorithm (micm_nlp.config.TokenizerConfig attribute) allowed_token_seqs (micm_nlp.training.logits_processors.ConstrainedPrefixLogitsProcessor attribute) analyze_lengths() (micm_nlp.datasets.dataset.DATASET method) APP_ENV (micm_nlp.bootstrap.Env attribute) apply_env_vars() (micm_nlp.config.CONFIG method) architecture (micm_nlp.config.ModelConfig attribute) args (micm_nlp.config.DataCollatorConfig attribute) (micm_nlp.config.InitModelConfigConfig attribute) (micm_nlp.config.PretrainedConfig attribute) (micm_nlp.config.TrainerConfig attribute) (micm_nlp.config.TrainingArgsConfig attribute) artefacts_dir() (in module micm_nlp.path) ATTN (micm_nlp.models.xpe.enums.CrossPromptEncoderReparameterizationType attribute) AYA (micm_nlp.enums.ModelArchSE attribute) B base_collator (micm_nlp.training.data_collators.DataCollatorTaskIDDecorator attribute) batch_decode() (in module micm_nlp.tokenizers.decoding) batch_size (micm_nlp.training.trainers.RandomTaskExclusionBatchSampler attribute) before_training (micm_nlp.config.EvalConfig attribute) before_training_on_test (micm_nlp.config.EvalConfig attribute) BENCHMARKS (micm_nlp.enums.DsCatSE attribute) BERT (micm_nlp.enums.ModelArchSE attribute) bert (micm_nlp.tokenizers.architectures.BertByT5Tokenizer attribute) bert_tok_name (micm_nlp.tokenizers.architectures.BertByT5Tokenizer attribute) BertByT5Tokenizer (class in micm_nlp.tokenizers.architectures) BertTokenSE (class in micm_nlp.enums) best_metric (micm_nlp.training.callbacks.CustomEarlyStoppingCallback attribute) BOS (micm_nlp.enums.BertTokenSE attribute) (micm_nlp.enums.ElectraTokenSE attribute) (micm_nlp.enums.RobertaTokenSE attribute) (micm_nlp.enums.T5TokenSE attribute) (micm_nlp.enums.XLMRobertaTokenSE attribute) (micm_nlp.enums.XLNetTokenSE attribute) BPE (micm_nlp.enums.TokAlgSE attribute) (micm_nlp.enums.TokTypeSE attribute) build_inference_dataloader_kwargs() (in module micm_nlp.training.trainers) byt5 (micm_nlp.tokenizers.architectures.BertByT5Tokenizer attribute) BYTE_LEVEL (micm_nlp.enums.TokTypeSE attribute) BYTE_LEVEL_BPE (micm_nlp.enums.TokTypeSE attribute) C calc_confusion_matrix (micm_nlp.config.PostprocConfig attribute) calc_confusion_matrix() (in module micm_nlp.evals.plot) calibrate_token_budget() (in module micm_nlp.training.batching) category (micm_nlp.config.DatasetConfig attribute) (micm_nlp.config.TaskConfig attribute) checkpoint (micm_nlp.config.AdapterConfig attribute) (micm_nlp.config.PretrainedConfig attribute) checkpoint_pref (micm_nlp.models.model.MODEL attribute) CLEAN (micm_nlp.enums.ModeSE attribute) cls (micm_nlp.config.DataCollatorConfig attribute) (micm_nlp.config.InitConfig attribute) (micm_nlp.config.InitModelConfigConfig attribute) (micm_nlp.config.PretrainedConfig attribute) (micm_nlp.config.TrainerConfig attribute) (micm_nlp.config.TrainingArgsConfig attribute) CLS (micm_nlp.enums.BertTokenSE attribute) (micm_nlp.enums.ElectraTokenSE attribute) (micm_nlp.enums.RobertaTokenSE attribute) (micm_nlp.enums.T5TokenSE attribute) (micm_nlp.enums.XLMRobertaTokenSE attribute) (micm_nlp.enums.XLNetTokenSE attribute) CLS_SOURCE_MODULES (micm_nlp.models.model.MODEL attribute) COLLECTIOS (micm_nlp.enums.DsCatSE attribute) comes_with_splits (micm_nlp.config.DatasetConfig attribute) COMPARISON (micm_nlp.enums.EvalTypeSE attribute) compute_log_likelihood_accurac() (in module micm_nlp.evals.metrics.log_likelihood) compute_metrics_by_metric_groups() (in module micm_nlp.evals.eval) compute_multirc() (in module micm_nlp.evals.metrics.multirc) CONFIG (class in micm_nlp.config) config (micm_nlp.config.InitConfig attribute) ConstrainedPrefixLogitsProcessor (class in micm_nlp.training.logits_processors) convert_label_names_to_floats() (in module micm_nlp.evals.eval) convert_label_names_to_ids() (in module micm_nlp.evals.eval) copy_simple_nsp() (in module micm_nlp.utils) CORPORA (micm_nlp.enums.DsCatSE attribute) count_decoded_unknown_label_predictions() (in module micm_nlp.evals.eval) CPU (micm_nlp.enums.DeviceSE attribute) create_optimizer() (micm_nlp.training.trainers.CustomTrainerMixin method) create_optimizer_and_scheduler() (micm_nlp.training.trainers.CustomTrainerMixin method) CrossPromptEncoder (class in micm_nlp.models.xpe.encoder) CrossPromptEncoderConfig (class in micm_nlp.models.xpe.config) CrossPromptEncoderReparameterizationType (class in micm_nlp.models.xpe.enums) CSV (micm_nlp.enums.DsTypeSE attribute) (micm_nlp.enums.SaveDatasetAsSE attribute) cuda (micm_nlp.config.CONFIG attribute) CUDA (micm_nlp.enums.DeviceSE attribute) CudaConfig (class in micm_nlp.config) custom_sent_ends_tt (micm_nlp.tokenizers.ka_sen_tok.KaSenTok attribute) custom_trainer_class_factory() (in module micm_nlp.training.trainers) custom_training_args (micm_nlp.config.CONFIG attribute) CustomDataCollatorForSeq2Seq_2 (class in micm_nlp.training.data_collators) CustomDataCollatorWithPadding (class in micm_nlp.training.data_collators) CustomEarlyStoppingCallback (class in micm_nlp.training.callbacks) CustomT5ForConditionalGeneration (class in micm_nlp.models.architectures) CustomTrainerMixin (class in micm_nlp.training.trainers) CustomTrainingArgsConfig (class in micm_nlp.config) CustomXlmRoberta (class in micm_nlp.tokenizers.architectures) D data_collator (micm_nlp.config.CONFIG attribute) DATA_COLLATOR_SOURCE_MODULES (micm_nlp.training.runner.TRAINER attribute) DataCollatorConfig (class in micm_nlp.config) DataCollatorForPLMWithPadding (class in micm_nlp.training.data_collators) DataCollatorForSeq2SeqWithShiftLabels (class in micm_nlp.training.data_collators) DataCollatorTaskIDDecorator (class in micm_nlp.training.data_collators) DATASET (class in micm_nlp.datasets.dataset) DatasetConfig (class in micm_nlp.config) datasets_dir() (in module micm_nlp.path) decode (micm_nlp.config.PostprocConfig attribute) decode() (in module micm_nlp.tokenizers.decoding) default() (micm_nlp.utils.NumpyEncoder method) descriptive_name (micm_nlp.config.DatasetConfig attribute) device (micm_nlp.training.callbacks.EmptyCudaCacheCallback attribute) DeviceSE (class in micm_nlp.enums) dict_diff() (in module micm_nlp.utils) dict_to_json_file() (in module micm_nlp.utils) dict_to_simple_nsp() (in module micm_nlp.utils) dict_to_yaml_file() (in module micm_nlp.utils) dirs (micm_nlp.config.DatasetConfig attribute) DMLM (micm_nlp.enums.TaskNameSE attribute) downstream_tasks (micm_nlp.config.EvalConfig attribute) DownstreamFineTuningCallback (class in micm_nlp.training.callbacks) drop_last (micm_nlp.training.trainers.RandomTaskExclusionBatchSampler attribute) dropout (micm_nlp.models.xpe.heads.LightweightSelfAttentionHead attribute) ds (micm_nlp.config.CONFIG attribute) DsCatSE (class in micm_nlp.enums) DsSplitSE (class in micm_nlp.enums) DsStateSE (class in micm_nlp.enums) DsTypeSE (class in micm_nlp.enums) during_training (micm_nlp.config.EvalConfig attribute) E early_stopping_after (micm_nlp.config.CustomTrainingArgsConfig attribute) (micm_nlp.training.callbacks.CustomEarlyStoppingCallback attribute) early_stopping_metric (micm_nlp.config.CustomTrainingArgsConfig attribute) (micm_nlp.training.callbacks.CustomEarlyStoppingCallback attribute) early_stopping_patience (micm_nlp.config.CustomTrainingArgsConfig attribute) early_stopping_threshold (micm_nlp.config.CustomTrainingArgsConfig attribute) ELECTRA (micm_nlp.enums.ModelArchSE attribute) ElectraTokenSE (class in micm_nlp.enums) embedding_freeze (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) embedding_init_type (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) embedding_normalize (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) embedding_normalize_max_norm (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) empty_cache_steps (micm_nlp.config.CudaConfig attribute) (micm_nlp.training.callbacks.EmptyCudaCacheCallback attribute) EmptyCudaCacheCallback (class in micm_nlp.training.callbacks) encoder_dropout (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) encoder_embedding_freeze (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) encoder_embedding_init_type (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) encoder_embedding_normalize (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) encoder_embedding_normalize_max_norm (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) encoder_freeze (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) encoder_hidden_size (micm_nlp.config.PeftConfig attribute) encoder_init_state_dict_path (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) encoder_input_size (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) encoder_num_heads (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) encoder_num_layers (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) encoder_ratio (micm_nlp.config.PeftConfig attribute) (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) encoder_reparameterization_type (micm_nlp.config.PeftConfig attribute) encoder_type (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) Env (class in micm_nlp.bootstrap) env (in module micm_nlp.bootstrap) (micm_nlp.config.CONFIG attribute) EOD (micm_nlp.enums.XLNetTokenSE attribute) EOP (micm_nlp.enums.XLNetTokenSE attribute) EOS (micm_nlp.enums.BertTokenSE attribute) (micm_nlp.enums.ElectraTokenSE attribute) (micm_nlp.enums.RobertaTokenSE attribute) (micm_nlp.enums.T5TokenSE attribute) (micm_nlp.enums.XLMRobertaTokenSE attribute) (micm_nlp.enums.XLNetTokenSE attribute) eval (micm_nlp.config.CONFIG attribute) eval_force_sequential (micm_nlp.config.CustomTrainingArgsConfig attribute) eval_max_tokens_per_batch (micm_nlp.config.CustomTrainingArgsConfig attribute) EvalConfig (class in micm_nlp.config) evals_dir() (in module micm_nlp.path) EvalTypeSE (class in micm_nlp.enums) EVALUATE (micm_nlp.enums.ModeSE attribute) extra_lines (micm_nlp.bootstrap.RichConfig attribute) extract_uuid_from_name() (micm_nlp.models.model.MODEL static method) F f1_score() (in module micm_nlp.evals.metrics.string_f1.string_f1) fasttokenizer_pref (in module micm_nlp.tokenizers.tokenizer) FILE_EXT_MAP (micm_nlp.datasets.dataset.DATASET attribute) file_len() (in module micm_nlp.utils) file_path (micm_nlp.config.CONFIG attribute) filter_by_prefixes (micm_nlp.config.PostprocConfig attribute) filter_kwargs_by_method_signature() (in module micm_nlp.utils) filter_padded (micm_nlp.config.PostprocConfig attribute) find_dirs_by_prefix() (in module micm_nlp.path) find_path_by_uuid4() (micm_nlp.models.model.MODEL static method) FINETUNE (micm_nlp.enums.ModeSE attribute) finetune_on_downstream_tasks() (micm_nlp.training.callbacks.DownstreamFineTuningCallback method) FlashSelfAttention (in module micm_nlp.models.architectures) flatten (micm_nlp.config.PostprocConfig attribute) format_seconds() (in module micm_nlp.utils) format_size() (in module micm_nlp.utils) forward() (micm_nlp.models.architectures.CustomT5ForConditionalGeneration method) (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) (micm_nlp.models.xpe.heads.LightweightSelfAttentionHead method) (micm_nlp.models.xpe.heads.LSTMWrapper method) from_peft_type() (micm_nlp.models.xpe.config.CrossPromptEncoderConfig class method) from_pretrained() (micm_nlp.models.peft.PEFT static method) from_yaml() (micm_nlp.config.CONFIG class method) G gb_coeff (micm_nlp.training.callbacks.EmptyCudaCacheCallback attribute) gen_attn_head() (in module micm_nlp.models.xpe.heads) gen_lstm_head() (in module micm_nlp.models.xpe.heads) gen_mlp_head() (in module micm_nlp.models.xpe.heads) gen_path() (in module micm_nlp.tokenizers.tokenizer) generation_config (micm_nlp.config.CONFIG attribute) generation_whitelist (micm_nlp.config.CustomTrainingArgsConfig attribute) get_base_model() (micm_nlp.models.model.MODEL static method) get_compute_metrics() (in module micm_nlp.evals.eval) get_concatenated_dataset() (micm_nlp.datasets.dataset.DATASET method) get_device() (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) get_dir_items() (in module micm_nlp.path) get_eval_dataloader() (micm_nlp.training.trainers.CustomTrainerMixin method) get_first_available_split() (micm_nlp.datasets.dataset.DATASET method) get_last_checkpoint() (micm_nlp.models.model.MODEL static method) get_last_checkpoint_path() (micm_nlp.models.model.MODEL static method) get_last_checkpoint_path_by_uuid4() (micm_nlp.models.model.MODEL static method) get_name() (micm_nlp.datasets.dataset.DATASET static method) get_path_by_uuid4_from_envs() (micm_nlp.models.model.MODEL static method) get_placeholder() (in module micm_nlp.utils) get_preprocess_logits_for_metrics() (in module micm_nlp.evals.eval) get_script_param() (in module micm_nlp.utils) get_test_dataloader() (micm_nlp.training.trainers.CustomTrainerMixin method) get_time_id() (in module micm_nlp.utils) get_total_virtual_tokens() (micm_nlp.models.peft.PEFT static method) get_train_dataloader() (micm_nlp.training.trainers.CustomTrainerMixin method) get_uuid_path_dict() (micm_nlp.models.model.MODEL static method) get_xpe_model() (in module micm_nlp.models.xpe.factory) GPU (micm_nlp.enums.DeviceSE attribute) group_preds_labels() (in module micm_nlp.evals.eval) H hf (micm_nlp.datasets.dataset.DATASET property) (micm_nlp.models.model.MODEL property) hf_name (micm_nlp.tokenizers.architectures.CustomXlmRoberta attribute) HF_TOKEN (micm_nlp.bootstrap.Env attribute) hidden_size (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) HUGGINGFACE (micm_nlp.enums.DsTypeSE attribute) (micm_nlp.enums.PretSourceSE attribute) (micm_nlp.enums.SaveDatasetAsSE attribute) HUGGINGFACE_SAVED (micm_nlp.enums.DsTypeSE attribute) HUGGINGFACE_SENTPIECE (micm_nlp.enums.TokTypeSE attribute) I id (micm_nlp.config.TaskConfig attribute) info() (in module micm_nlp.utils) init (micm_nlp.config.ModelConfig attribute) init() (in module micm_nlp.bootstrap) init_embeddings() (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) init_rich() (in module micm_nlp.bootstrap) init_state_dict_path (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) InitConfig (class in micm_nlp.config) InitModelConfigConfig (class in micm_nlp.config) input (micm_nlp.config.DatasetConfig attribute) input_len_longer_than() (micm_nlp.datasets.dataset.DATASET method) input_size (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) InputConfig (class in micm_nlp.config) is_peft() (micm_nlp.models.peft.PEFT static method) is_sublist() (in module micm_nlp.utils) is_valid_uuid() (in module micm_nlp.utils) is_xpe_adapter_dir() (in module micm_nlp.models.xpe.factory) is_xpe_config() (in module micm_nlp.models.xpe.factory) J JSON (micm_nlp.enums.DsTypeSE attribute) json_dumps() (in module micm_nlp.utils) json_dumps_numpy() (in module micm_nlp.utils) json_dumps_simple_nsp() (in module micm_nlp.utils) json_file_to_dict() (in module micm_nlp.utils) json_file_to_simple_nsp() (in module micm_nlp.utils) json_load_simple_nsp() (in module micm_nlp.utils) K KA (micm_nlp.enums.SentTokTypeSE attribute) KaSenTok (class in micm_nlp.tokenizers.ka_sen_tok) keep_only_final_model (micm_nlp.config.CustomTrainingArgsConfig attribute) key (micm_nlp.config.InputConfig attribute) (micm_nlp.config.LabelConfig attribute) (micm_nlp.config.TaskIdConfig attribute) key_2 (micm_nlp.config.InputConfig attribute) key_3 (micm_nlp.config.InputConfig attribute) keys (micm_nlp.datasets.dataset.DATASET attribute) L label (micm_nlp.config.DatasetConfig attribute) label_id_to_name (micm_nlp.config.PostprocConfig attribute) label_len_longer_than() (micm_nlp.datasets.dataset.DATASET method) label_name_strip_lower (micm_nlp.config.PostprocConfig attribute) label_name_to_float (micm_nlp.config.PostprocConfig attribute) label_name_to_id (micm_nlp.config.PostprocConfig attribute) label_pad_token_id (micm_nlp.training.data_collators.CustomDataCollatorForSeq2Seq_2 attribute) label_restricted_likelihood (micm_nlp.config.PostprocConfig attribute) LabelConfig (class in micm_nlp.config) labels_k (in module micm_nlp.evals.eval) LANGUAGE_MODELING (micm_nlp.enums.TaskCatSE attribute) layernorm (micm_nlp.models.xpe.heads.LightweightSelfAttentionHead attribute) LightweightSelfAttentionHead (class in micm_nlp.models.xpe.heads) load() (in module micm_nlp.tokenizers.tokenizer) load_dataset() (in module micm_nlp.pipeline) load_model() (in module micm_nlp.pipeline) load_pretrained_state() (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) load_xpe_pretrained() (in module micm_nlp.models.xpe.factory) LOCAL (micm_nlp.enums.PretSourceSE attribute) logger (in module micm_nlp.training.trainers) LONG (micm_nlp.enums.DsStateSE attribute) longest_input_len() (micm_nlp.datasets.dataset.DATASET method) longest_label_len() (micm_nlp.datasets.dataset.DATASET method) LSTM (micm_nlp.models.xpe.enums.CrossPromptEncoderReparameterizationType attribute) lstm (micm_nlp.models.xpe.heads.LSTMWrapper attribute) LSTMWrapper (class in micm_nlp.models.xpe.heads) M MASK (micm_nlp.enums.BertTokenSE attribute) (micm_nlp.enums.ElectraTokenSE attribute) (micm_nlp.enums.RobertaTokenSE attribute) (micm_nlp.enums.T5TokenSE attribute) (micm_nlp.enums.XLMRobertaTokenSE attribute) (micm_nlp.enums.XLNetTokenSE attribute) max_length (micm_nlp.training.data_collators.CustomDataCollatorForSeq2Seq_2 attribute) (micm_nlp.training.data_collators.CustomDataCollatorWithPadding attribute) (micm_nlp.training.data_collators.DataCollatorForPLMWithPadding attribute) maybe_load_pretrained_classifier_state() (in module micm_nlp.models.xpe.factory) MEASUREMENT (micm_nlp.enums.EvalTypeSE attribute) METRIC (micm_nlp.enums.EvalTypeSE attribute) metric_groups (micm_nlp.config.TaskConfig attribute) micm_nlp module micm_nlp.bootstrap module micm_nlp.config module micm_nlp.datasets module micm_nlp.datasets.dataset module micm_nlp.enums module micm_nlp.evals module micm_nlp.evals.eval module micm_nlp.evals.metrics module micm_nlp.evals.metrics.log_likelihood module micm_nlp.evals.metrics.multirc module micm_nlp.evals.metrics.string_f1 module micm_nlp.evals.metrics.string_f1.string_f1 module micm_nlp.evals.plot module micm_nlp.models module micm_nlp.models.architectures module micm_nlp.models.model module micm_nlp.models.peft module micm_nlp.models.xpe module micm_nlp.models.xpe.config module micm_nlp.models.xpe.encoder module micm_nlp.models.xpe.enums module micm_nlp.models.xpe.factory module micm_nlp.models.xpe.heads module micm_nlp.models.xpe.peft_models module micm_nlp.models.xpe.save_load module micm_nlp.path module micm_nlp.pipeline module micm_nlp.tokenizers module micm_nlp.tokenizers.architectures module micm_nlp.tokenizers.decoding module micm_nlp.tokenizers.ka_sen_tok module micm_nlp.tokenizers.tokenizer module micm_nlp.training module micm_nlp.training.batching module micm_nlp.training.callbacks module micm_nlp.training.data_collators module micm_nlp.training.logits_processors module micm_nlp.training.runner module micm_nlp.training.trainers module micm_nlp.utils module MicmNlpConfig (class in micm_nlp.bootstrap) min_frequency (micm_nlp.tokenizers.tokenizer.TokenizerTrainer attribute) MLM (micm_nlp.enums.TaskNameSE attribute) MLP (micm_nlp.models.xpe.enums.CrossPromptEncoderReparameterizationType attribute) mlp (micm_nlp.models.xpe.heads.LSTMWrapper attribute) mode (micm_nlp.config.CONFIG attribute) MODEL (class in micm_nlp.models.model) model (micm_nlp.config.CONFIG attribute) (micm_nlp.training.data_collators.CustomDataCollatorForSeq2Seq_2 attribute) model_config (micm_nlp.bootstrap.Env attribute) ModelArchSE (class in micm_nlp.enums) ModelConfig (class in micm_nlp.config) models_dir() (in module micm_nlp.path) ModeSE (class in micm_nlp.enums) module micm_nlp micm_nlp.bootstrap micm_nlp.config micm_nlp.datasets micm_nlp.datasets.dataset micm_nlp.enums micm_nlp.evals micm_nlp.evals.eval micm_nlp.evals.metrics micm_nlp.evals.metrics.log_likelihood micm_nlp.evals.metrics.multirc micm_nlp.evals.metrics.string_f1 micm_nlp.evals.metrics.string_f1.string_f1 micm_nlp.evals.plot micm_nlp.models micm_nlp.models.architectures micm_nlp.models.model micm_nlp.models.peft micm_nlp.models.xpe micm_nlp.models.xpe.config micm_nlp.models.xpe.encoder micm_nlp.models.xpe.enums micm_nlp.models.xpe.factory micm_nlp.models.xpe.heads micm_nlp.models.xpe.peft_models micm_nlp.models.xpe.save_load micm_nlp.path micm_nlp.pipeline micm_nlp.tokenizers micm_nlp.tokenizers.architectures micm_nlp.tokenizers.decoding micm_nlp.tokenizers.ka_sen_tok micm_nlp.tokenizers.tokenizer micm_nlp.training micm_nlp.training.batching micm_nlp.training.callbacks micm_nlp.training.data_collators micm_nlp.training.logits_processors micm_nlp.training.runner micm_nlp.training.trainers micm_nlp.utils modules_to_save (micm_nlp.models.xpe.config.CrossPromptEncoderConfig attribute) monkey_patch_globally() (in module micm_nlp.utils) N name (micm_nlp.config.AdapterConfig attribute) (micm_nlp.config.DatasetConfig attribute) (micm_nlp.config.PretrainedConfig attribute) (micm_nlp.config.TaskConfig attribute) (micm_nlp.config.TokenizerConfig attribute) names (micm_nlp.config.LabelConfig attribute) NATIVE_SENTPIECE (micm_nlp.enums.TokTypeSE attribute) NER (micm_nlp.enums.TaskNameSE attribute) NLTK (micm_nlp.enums.SentTokTypeSE attribute) NLTK_PUNCT (micm_nlp.enums.WordTokTypeSE attribute) NLTK_WHITESPACE (micm_nlp.enums.WordTokTypeSE attribute) NONE (micm_nlp.enums.DsSplitSE attribute) (micm_nlp.models.xpe.enums.CrossPromptEncoderReparameterizationType attribute) normalize_answer() (in module micm_nlp.evals.metrics.string_f1.string_f1) normalize_embeddings() (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) NormalizePromptEncoderEmbeddings (class in micm_nlp.training.callbacks) num_batches (micm_nlp.training.trainers.RandomTaskExclusionBatchSampler attribute) num_heads (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) num_tasks (micm_nlp.config.PeftConfig attribute) num_transformer_submodules (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) num_virtual_tokens (micm_nlp.config.PeftConfig attribute) number (micm_nlp.config.LabelConfig attribute) NumpyEncoder (class in micm_nlp.utils) O on_evaluate() (micm_nlp.training.callbacks.CustomEarlyStoppingCallback method) (micm_nlp.training.callbacks.DownstreamFineTuningCallback method) on_save() (micm_nlp.training.callbacks.DownstreamFineTuningCallback method) on_step_end() (micm_nlp.training.callbacks.EmptyCudaCacheCallback method) (micm_nlp.training.callbacks.NormalizePromptEncoderEmbeddings method) (micm_nlp.training.callbacks.ParamNormLogger method) on_train_begin() (micm_nlp.training.callbacks.DownstreamFineTuningCallback method) on_train_end() (micm_nlp.training.callbacks.DownstreamFineTuningCallback method) optimizer_grouped_parameters (micm_nlp.config.CustomTrainingArgsConfig attribute) order (micm_nlp.training.batching.TokenBudgetBatchSampler property) original_indices_by_task (micm_nlp.training.trainers.RandomTaskExclusionBatchSampler attribute) out_proj (micm_nlp.models.xpe.heads.LightweightSelfAttentionHead attribute) output_size (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) P p() (in module micm_nlp.utils) PACKAGE_DIR (in module micm_nlp.path) PAD (micm_nlp.enums.BertTokenSE attribute) (micm_nlp.enums.ElectraTokenSE attribute) (micm_nlp.enums.RobertaTokenSE attribute) (micm_nlp.enums.T5TokenSE attribute) (micm_nlp.enums.XLMRobertaTokenSE attribute) (micm_nlp.enums.XLNetTokenSE attribute) pad_to_multiple_of (micm_nlp.training.data_collators.CustomDataCollatorForSeq2Seq_2 attribute) (micm_nlp.training.data_collators.CustomDataCollatorWithPadding attribute) padded (micm_nlp.config.LabelConfig attribute) padding (micm_nlp.training.data_collators.CustomDataCollatorForSeq2Seq_2 attribute) (micm_nlp.training.data_collators.CustomDataCollatorWithPadding attribute) (micm_nlp.training.data_collators.DataCollatorForPLMWithPadding attribute) param_size (micm_nlp.config.ModelConfig attribute) ParamNormLogger (class in micm_nlp.training.callbacks) parse_config_name() (in module micm_nlp.utils) parse_script_args() (in module micm_nlp.utils) patience_counter (micm_nlp.training.callbacks.CustomEarlyStoppingCallback attribute) PEFT (class in micm_nlp.models.peft) peft (micm_nlp.config.CONFIG attribute) peft_type (micm_nlp.config.PeftConfig attribute) PeftConfig (class in micm_nlp.config) per_task (micm_nlp.config.EvalConfig attribute) pickle_load() (in module micm_nlp.utils) pickle_save() (in module micm_nlp.utils) PLM (micm_nlp.enums.TaskNameSE attribute) POS (micm_nlp.enums.TaskNameSE attribute) post_processors_map (in module micm_nlp.tokenizers.tokenizer) postproc_metrics() (in module micm_nlp.evals.eval) PostprocConfig (class in micm_nlp.config) prediction_axis (micm_nlp.config.PostprocConfig attribute) prediction_step() (micm_nlp.training.trainers.CustomTrainerMixin method) predictions_k (in module micm_nlp.evals.eval) preproc_preds_labels() (in module micm_nlp.evals.eval) preproc_rules (micm_nlp.config.DatasetConfig attribute) (micm_nlp.config.TaskConfig attribute) PREPROCESS (micm_nlp.enums.ModeSE attribute) preprocess() (micm_nlp.datasets.dataset.DATASET method) preprocess_dataset() (in module micm_nlp.pipeline) pretrained (micm_nlp.config.ModelConfig attribute) PretrainedConfig (class in micm_nlp.config) PretSourceSE (class in micm_nlp.enums) pretty_output (micm_nlp.bootstrap.MicmNlpConfig attribute) prev_params (micm_nlp.training.callbacks.ParamNormLogger attribute) print_all_layers() (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) print_batch_examples() (micm_nlp.training.runner.TRAINER method) print_details() (micm_nlp.training.runner.TRAINER method) print_examples_from_splits() (micm_nlp.datasets.dataset.DATASET method) print_list() (in module micm_nlp.utils) print_named_parameters() (micm_nlp.models.model.MODEL method) print_stack() (in module micm_nlp.utils) print_traceback() (in module micm_nlp.utils) print_trainable_layers() (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) PROJECT_ROOT_PATH (micm_nlp.bootstrap.Env attribute) prompt_encoder_key (micm_nlp.models.peft.PEFT attribute) R random_task_exclusion (micm_nlp.config.CustomTrainingArgsConfig attribute) RandomTaskExclusionBatchSampler (class in micm_nlp.training.trainers) RAW (micm_nlp.enums.DsCatSE attribute) read_jsons_in_folder() (in module micm_nlp.utils) reinit() (micm_nlp.models.model.MODEL method) remove_digits_tt (micm_nlp.tokenizers.ka_sen_tok.KaSenTok attribute) replace_unk_token_manually() (in module micm_nlp.tokenizers.tokenizer) report_to_wandb (micm_nlp.config.TestConfig attribute) resolve_cls() (in module micm_nlp.utils) return_tensors (micm_nlp.training.data_collators.CustomDataCollatorForSeq2Seq_2 attribute) (micm_nlp.training.data_collators.CustomDataCollatorWithPadding attribute) (micm_nlp.training.data_collators.DataCollatorForPLMWithPadding attribute) RichConfig (class in micm_nlp.bootstrap) ROBERTA (micm_nlp.enums.ModelArchSE attribute) RobertaTokenSE (class in micm_nlp.enums) root_path (micm_nlp.bootstrap.MicmNlpConfig attribute) run (micm_nlp.config.TestConfig attribute) run() (in module micm_nlp.pipeline) (micm_nlp.training.runner.TRAINER method) S SA (micm_nlp.enums.TaskNameSE attribute) safe_json_default() (in module micm_nlp.utils) save() (micm_nlp.datasets.dataset.DATASET method) save_final_model (micm_nlp.config.CustomTrainingArgsConfig attribute) save_lm_adapted_hf_tokenizers() (micm_nlp.tokenizers.tokenizer.TokenizerTrainer method) save_lm_adapted_native_sentpieces() (micm_nlp.tokenizers.tokenizer.TokenizerTrainer method) save_predictions (micm_nlp.config.TestConfig attribute) SaveDatasetAsSE (class in micm_nlp.enums) scientific_notation_to_float() (in module micm_nlp.utils) seed (micm_nlp.datasets.dataset.DATASET attribute) self_attn (micm_nlp.models.xpe.heads.LightweightSelfAttentionHead attribute) SENTINEL_BEST (micm_nlp.training.callbacks.CustomEarlyStoppingCallback attribute) sentpiece_pref (micm_nlp.tokenizers.tokenizer.TokenizerTrainer attribute) SentTokTypeSE (class in micm_nlp.enums) SEP (micm_nlp.enums.BertTokenSE attribute) (micm_nlp.enums.ElectraTokenSE attribute) (micm_nlp.enums.RobertaTokenSE attribute) (micm_nlp.enums.T5TokenSE attribute) (micm_nlp.enums.XLMRobertaTokenSE attribute) (micm_nlp.enums.XLNetTokenSE attribute) set_grad_requirements() (micm_nlp.models.xpe.encoder.CrossPromptEncoder method) set_root() (in module micm_nlp.path) setup_model() (micm_nlp.models.peft.PEFT static method) shift_labels_by (micm_nlp.training.data_collators.DataCollatorForSeq2SeqWithShiftLabels attribute) SHORT (micm_nlp.enums.DsStateSE attribute) SHOW_LOCALS (micm_nlp.bootstrap.Env attribute) show_locals (micm_nlp.bootstrap.RichConfig attribute) simple_nsp_to_dict() (in module micm_nlp.utils) simple_nsp_to_json_file() (in module micm_nlp.utils) simple_nsp_to_yaml_file() (in module micm_nlp.utils) simple_nsps_to_params() (in module micm_nlp.utils) sizeof_file() (in module micm_nlp.utils) sizeof_object() (in module micm_nlp.utils) source (micm_nlp.config.AdapterConfig attribute) (micm_nlp.config.PretrainedConfig attribute) (micm_nlp.config.TokenizerConfig attribute) spacy (in module micm_nlp.tokenizers.tokenizer) SPACY (micm_nlp.enums.SentTokTypeSE attribute) special_tokens_map (in module micm_nlp.tokenizers.tokenizer) SPLITS (micm_nlp.enums.DsStateSE attribute) SplitsConfig (class in micm_nlp.config) spt_virtual_tokens (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) standardize_key (micm_nlp.config.InputConfig attribute) (micm_nlp.config.LabelConfig attribute) (micm_nlp.config.TaskIdConfig attribute) store_path_by_uuid4_in_envs() (micm_nlp.models.model.MODEL static method) StrEnum (class in micm_nlp.enums) StringF1 (class in micm_nlp.evals.metrics.string_f1.string_f1) STRUCTURAL_ANALYSIS (micm_nlp.enums.TaskCatSE attribute) SUBSET (micm_nlp.enums.DsStateSE attribute) T T5 (micm_nlp.enums.ModelArchSE attribute) T5TokenSE (class in micm_nlp.enums) task (micm_nlp.config.CONFIG attribute) task_id (micm_nlp.config.DatasetConfig attribute) (micm_nlp.training.data_collators.DataCollatorTaskIDDecorator attribute) task_ids (micm_nlp.training.trainers.RandomTaskExclusionBatchSampler attribute) task_type (micm_nlp.config.PeftConfig attribute) TASK_TYPE_TO_XPE_MODEL (in module micm_nlp.models.xpe.peft_models) TaskCatSE (class in micm_nlp.enums) TaskConfig (class in micm_nlp.config) TaskIdConfig (class in micm_nlp.config) TaskNameSE (class in micm_nlp.enums) test (micm_nlp.config.CONFIG attribute) (micm_nlp.config.SplitsConfig attribute) TEST (micm_nlp.enums.DsSplitSE attribute) (micm_nlp.enums.ModeSE attribute) test_force_sequential (micm_nlp.config.CustomTrainingArgsConfig attribute) test_max_tokens_per_batch (micm_nlp.config.CustomTrainingArgsConfig attribute) TestConfig (class in micm_nlp.config) TEXT (micm_nlp.enums.DsTypeSE attribute) TEXT_CLASSIFICATION (micm_nlp.enums.TaskCatSE attribute) TEXT_GENERATION (micm_nlp.enums.TaskCatSE attribute) TEXT_PAIR_CLASSIFICATION (micm_nlp.enums.TaskCatSE attribute) TEXT_SIMILARITIY (micm_nlp.enums.TaskCatSE attribute) TEXT_TO_TEXT (micm_nlp.enums.TaskCatSE attribute) tik() (in module micm_nlp.utils) to_lm_fasttok() (in module micm_nlp.tokenizers.tokenizer) to_utf8_if_binary() (in module micm_nlp.utils) TokAlgSE (class in micm_nlp.enums) TOKEN_CLASSIFICATION (micm_nlp.enums.TaskCatSE attribute) token_dim (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) TokenBudgetBatchSampler (class in micm_nlp.training.batching) tokenize() (micm_nlp.tokenizers.ka_sen_tok.KaSenTok method) tokenize_sentences() (in module micm_nlp.tokenizers.tokenizer) tokenize_words() (in module micm_nlp.tokenizers.tokenizer) TOKENIZED (micm_nlp.enums.DsStateSE attribute) tokenizer (micm_nlp.config.CONFIG attribute) (micm_nlp.tokenizers.ka_sen_tok.KaSenTok attribute) (micm_nlp.training.data_collators.CustomDataCollatorForSeq2Seq_2 attribute) (micm_nlp.training.data_collators.CustomDataCollatorWithPadding attribute) (micm_nlp.training.data_collators.DataCollatorForPLMWithPadding attribute) (micm_nlp.training.logits_processors.ConstrainedPrefixLogitsProcessor attribute) TokenizerConfig (class in micm_nlp.config) tokenizers_args_map (in module micm_nlp.tokenizers.tokenizer) tokenizers_dir() (in module micm_nlp.path) tokenizers_map (in module micm_nlp.tokenizers.tokenizer) TokenizerTrainer (class in micm_nlp.tokenizers.tokenizer) TokTypeSE (class in micm_nlp.enums) TOPIC (micm_nlp.enums.TaskNameSE attribute) torch_call() (micm_nlp.training.data_collators.DataCollatorForPLMWithPadding method) total_examples (micm_nlp.training.trainers.RandomTaskExclusionBatchSampler attribute) total_virtual_tokens (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) train (micm_nlp.config.SplitsConfig attribute) TRAIN (micm_nlp.enums.DsSplitSE attribute) (micm_nlp.enums.ModeSE attribute) train() (micm_nlp.tokenizers.tokenizer.TokenizerTrainer method) train_force_sequential (micm_nlp.config.CustomTrainingArgsConfig attribute) train_hf_byte_level_bpe() (micm_nlp.tokenizers.tokenizer.TokenizerTrainer method) train_hf_wordpiece() (micm_nlp.tokenizers.tokenizer.TokenizerTrainer method) train_native_sentpiece() (micm_nlp.tokenizers.tokenizer.TokenizerTrainer method) trainable_param_size (micm_nlp.config.ModelConfig attribute) trainable_param_size_ratio (micm_nlp.config.ModelConfig attribute) TRAINER (class in micm_nlp.training.runner) trainer (micm_nlp.config.CONFIG attribute) TRAINER_SOURCE_MODULES (micm_nlp.training.runner.TRAINER attribute) TrainerConfig (class in micm_nlp.config) training_args (micm_nlp.config.CONFIG attribute) TRAINING_ARGS_SOURCE_MODULES (micm_nlp.training.runner.TRAINER attribute) TrainingArgsConfig (class in micm_nlp.config) try_set_add() (in module micm_nlp.utils) type (micm_nlp.config.DatasetConfig attribute) (micm_nlp.config.TokenizerConfig attribute) (micm_nlp.tokenizers.tokenizer.TokenizerTrainer attribute) U UNIGRAM (micm_nlp.enums.TokAlgSE attribute) unigram_pref (micm_nlp.tokenizers.tokenizer.TokenizerTrainer attribute) UNK (micm_nlp.enums.BertTokenSE attribute) (micm_nlp.enums.ElectraTokenSE attribute) (micm_nlp.enums.RobertaTokenSE attribute) (micm_nlp.enums.T5TokenSE attribute) (micm_nlp.enums.XLMRobertaTokenSE attribute) (micm_nlp.enums.XLNetTokenSE attribute) update_simple_nsp() (in module micm_nlp.utils) usable_columns (micm_nlp.config.CustomTrainingArgsConfig attribute) uuid4 (micm_nlp.config.AdapterConfig attribute) (micm_nlp.config.ModelConfig attribute) (micm_nlp.config.PretrainedConfig attribute) V validation (micm_nlp.config.SplitsConfig attribute) VALIDATION (micm_nlp.enums.DsSplitSE attribute) verify_labels_match (micm_nlp.config.PostprocConfig attribute) verify_labels_match() (in module micm_nlp.evals.eval) vocab_size (micm_nlp.config.TokenizerConfig attribute) (micm_nlp.tokenizers.tokenizer.TokenizerTrainer attribute) vocab_size_by_lm_size() (in module micm_nlp.tokenizers.tokenizer) W WANDB_API_KEY (micm_nlp.bootstrap.Env attribute) wandb_dir() (in module micm_nlp.path) whitespace_tokenize (in module micm_nlp.tokenizers.tokenizer) width (micm_nlp.bootstrap.RichConfig attribute) WORDPIECE (micm_nlp.enums.TokTypeSE attribute) WordTokTypeSE (class in micm_nlp.enums) workspace() (in module micm_nlp.path) X XGLM (micm_nlp.enums.ModelArchSE attribute) XLMR (micm_nlp.enums.ModelArchSE attribute) xlmr (micm_nlp.tokenizers.architectures.CustomXlmRoberta attribute) XLMRobertaTokenSE (class in micm_nlp.enums) XLNET (micm_nlp.enums.ModelArchSE attribute) XLNetTokenSE (class in micm_nlp.enums) xpe_get_peft_model_state_dict() (in module micm_nlp.models.xpe.save_load) xpe_model_for() (in module micm_nlp.models.xpe.peft_models) xpe_set_peft_model_state_dict() (in module micm_nlp.models.xpe.save_load) xpe_virtual_tokens (micm_nlp.models.xpe.encoder.CrossPromptEncoder attribute) XPEPeftModelForCausalLM (class in micm_nlp.models.xpe.peft_models) XPEPeftModelForSequenceClassification (class in micm_nlp.models.xpe.peft_models) Y Y (micm_nlp.config.DatasetConfig attribute) yaml_file_to_dict() (in module micm_nlp.utils) yaml_file_to_simple_nsp() (in module micm_nlp.utils) Z zero_shot (micm_nlp.config.TestConfig attribute) zero_shot_only (micm_nlp.config.TestConfig attribute)