MCPcopy Create free account

hub / github.com/jingyaogong/minimind / functions

Functions142 in github.com/jingyaogong/minimind

↓ 69 callersFunctionLogger
(content)
trainer/trainer_utils.py:35
↓ 23 callersFunctionis_main_process
()
trainer/trainer_utils.py:31
↓ 18 callersFunctionsetup_seed
(seed: int)
trainer/trainer_utils.py:54
↓ 16 callersFunctionlm_checkpoint
(lm_config, weight='full_sft', model=None, optimizer=None, epoch=0, step=0, wandb=None, save_dir='../checkpoin
trainer/trainer_utils.py:63
↓ 13 callersFunctioninit_model
(lm_config, from_weight='pretrain', tokenizer_path='../model', save_dir='../out', device='cuda')
trainer/trainer_utils.py:119
↓ 9 callersFunctionget_text
(key)
scripts/web_demo.py:102
↓ 9 callersMethodupdate_policy
(self, model: torch.nn.Module)
trainer/rollout_engine.py:59
↓ 8 callersFunctioninit_distributed_mode
()
trainer/trainer_utils.py:44
↓ 7 callersMethod__init__
(self, dim: int, eps: float = 1e-5)
model/model_minimind.py:51
↓ 5 callersMethodgenerate
(self, inputs=None, attention_mask=None, max_new_tokens=8192, temperature=0.85, top_p=0.85, top_k=50, eos_toke
model/model_minimind.py:257
↓ 5 callersFunctionget_lr
(current_step, total_steps, lr)
trainer/trainer_utils.py:40
↓ 5 callersFunctionprocess_assistant_content
(content, is_streaming=False)
scripts/web_demo.py:149
↓ 4 callersMethod__init__
(self, jsonl_path, tokenizer, max_length=1024)
dataset/lm_dataset.py:59
↓ 4 callersFunctionapply_lora
(model, rank=16)
model/model_lora.py:21
↓ 3 callersFunctioncreate_rollout_engine
( engine_type: str = "torch", policy_model: torch.nn.Module = None, tokenizer = None, device:
trainer/rollout_engine.py:209
↓ 3 callersFunctionget_model_params
(model, config)
trainer/trainer_utils.py:18
↓ 3 callersMethodget_score
(self, messages, response)
trainer/trainer_utils.py:168
↓ 3 callersFunctionload_lora
(model, path)
model/model_lora.py:35
↓ 3 callersMethodnorm
(self, x)
model/model_minimind.py:56
↓ 3 callersFunctionpost_processing_chat
(prompt_content, empty_think_ratio=0.2)
dataset/lm_dataset.py:31
↓ 3 callersMethodrollout
(self, prompt_ids: Tensor, attention_mask: Tensor, num_generations: int, max_new_tokens: int, temperature: flo
trainer/rollout_engine.py:55
↓ 2 callersFunctioncompute_per_token_logps
(model, input_ids: Tensor, n_keep: int, attention_mask: Optional[Tensor] = None)
trainer/rollout_engine.py:24
↓ 2 callersMethodgenerate_loss_mask
(self, input_ids)
dataset/lm_dataset.py:176
↓ 2 callersMethodget_open_thinking
兼容多种方式开启 thinking
scripts/serve_openai_api.py:61
↓ 2 callersFunctiongrpo_train_epoch
(epoch, loader, iters, rollout_engine, ref_model, reward_model, start_step=0, wandb=None, use_sglang=False)
trainer/train_grpo.py:71
↓ 2 callersFunctionlogits_to_log_probs
(logits, labels)
trainer/train_dpo.py:25
↓ 2 callersFunctionparse_response
(text)
scripts/serve_openai_api.py:83
↓ 2 callersFunctionparse_tool_call_from_text
(content)
scripts/eval_toolcall.py:81
↓ 2 callersFunctionparse_tool_calls
(text)
trainer/train_agent.py:77
↓ 2 callersFunctionppo_train_epoch
(epoch, loader, iters, rollout_engine, ref_model, actor_scheduler, critic_scheduler, reward_model, start_step=
trainer/train_ppo.py:79
↓ 2 callersFunctionpre_processing_chat
(conversations, add_system_ratio=0.2)
dataset/lm_dataset.py:9
↓ 2 callersFunctionprecompute_freqs_cis
(dim: int, end: int = int(32 * 1024), rope_base: float = 1e6, rope_scaling: dict = None)
model/model_minimind.py:62
↓ 2 callersFunctionrep_penalty
(text, n=3, cap=0.5)
trainer/train_agent.py:34
↓ 2 callersFunctionrepeat_kv
(x: torch.Tensor, n_rep: int)
model/model_minimind.py:86
↓ 2 callersFunctionrl_train_epoch
(epoch, loader, iters, rollout_engine, ref_model, reward_model=None, start_step=0, wandb=None, use_sglang=Fals
trainer/train_agent.py:242
↓ 2 callersFunctionrotate_half
(x)
model/model_minimind.py:81
↓ 2 callersFunctiontrain_epoch
(epoch, loader, iters, lora_params, start_step=0, wandb=None)
trainer/train_lora.py:25
↓ 2 callersFunctiontrain_epoch
(epoch, loader, iters, start_step=0, wandb=None)
trainer/train_pretrain.py:24
↓ 2 callersFunctiontrain_epoch
(epoch, loader, iters, start_step=0, wandb=None)
trainer/train_full_sft.py:24
↓ 2 callersFunctiontrain_epoch
(epoch, loader, iters, ref_model, lm_config, start_step=0, wandb=None, beta=0.1)
trainer/train_dpo.py:53
↓ 2 callersFunctiontrain_epoch
(epoch, loader, iters, teacher_model, lm_config_student, start_step=0, wandb=None, alpha=0.0, temperature=1.0)
trainer/train_distillation.py:39
↓ 1 callersFunctionapply_rotary_pos_emb
(q, k, cos, sin, unsqueeze_dim=1)
model/model_minimind.py:80
↓ 1 callersFunctioncalculate_rewards
(prompts, responses, reward_model)
trainer/train_ppo.py:52
↓ 1 callersFunctioncalculate_rewards
(prompts, completions, gt_batch, tools_batch, num_gen, reward_model=None, device="cuda", turn_outputs_batch=No
trainer/train_agent.py:188
↓ 1 callersFunctioncalculate_rewards
(prompts, responses, reward_model)
trainer/train_grpo.py:37
↓ 1 callersFunctionchat_api
(client, messages, tools, args, stream=True)
scripts/eval_toolcall.py:133
↓ 1 callersFunctionconvert_torch2transformers
(torch_path, transformers_path, dtype=torch.float16)
scripts/convert_model.py:40
↓ 1 callersMethodcreate_chat_prompt
(self, conversations)
dataset/lm_dataset.py:71
↓ 1 callersMethodcreate_chat_prompt
(self, conversations)
dataset/lm_dataset.py:208
↓ 1 callersFunctiondistillation_loss
(student_logits, teacher_logits, temperature=1.0, reduction='batchmean')
trainer/train_distillation.py:25
↓ 1 callersFunctiondpo_loss
(ref_log_probs, policy_log_probs, mask, beta)
trainer/train_dpo.py:34
↓ 1 callersFunctioneval_tokenizer
(tokenizer_dir)
trainer/train_tokenizer.py:108
↓ 1 callersFunctionexecute_tool
(call, arguments=None)
scripts/eval_toolcall.py:99
↓ 1 callersFunctionexecute_tool
(tool_name, args)
scripts/web_demo.py:124
↓ 1 callersFunctionexecute_tool
(name, args)
trainer/train_agent.py:84
↓ 1 callersMethodforward
(self, input_ids, attention_mask=None, past_key_values=None, use_cache=False, logits_to_keep=0, labels=None, *
model/model_minimind.py:245
↓ 1 callersFunctiongenerate
(model, tokenizer, messages, tools, args)
scripts/eval_toolcall.py:115
↓ 1 callersMethodgenerate_labels
(self, input_ids)
dataset/lm_dataset.py:88
↓ 1 callersFunctiongenerate_stream_response
(messages, temperature, top_p, max_tokens, tools=None, open_thinking=False)
scripts/serve_openai_api.py:105
↓ 1 callersFunctionget_texts
(data_path)
trainer/train_tokenizer.py:12
↓ 1 callersFunctionget_tools
(names)
scripts/eval_toolcall.py:42
↓ 1 callersFunctioninit_model
(args)
eval_llm.py:12
↓ 1 callersFunctioninit_model
(args)
scripts/serve_openai_api.py:28
↓ 1 callersFunctioninit_model
(args)
scripts/eval_toolcall.py:57
↓ 1 callersFunctionload_model_tokenizer
(model_path)
scripts/web_demo.py:199
↓ 1 callersFunctionmain
()
eval_llm.py:32
↓ 1 callersFunctionmain
()
scripts/eval_toolcall.py:202
↓ 1 callersFunctionmain
()
scripts/web_demo.py:312
↓ 1 callersFunctionmerge_lora
(model, lora_path, save_path)
model/model_lora.py:56
↓ 1 callersMethodparse_conversations
(self, conversations)
dataset/lm_dataset.py:239
↓ 1 callersFunctionparse_tool_calls
(text)
scripts/eval_toolcall.py:70
↓ 1 callersFunctionrep_penalty
(text, n=3, cap=0.5)
trainer/train_ppo.py:30
↓ 1 callersFunctionrep_penalty
(text, n=3, cap=0.5)
trainer/train_grpo.py:31
↓ 1 callersFunctionrollout_batch
(rollout_engine, tokenizer, messages_batch, tools_batch, num_gen, max_turns=3, max_new_tokens=256, thinking_ra
trainer/train_agent.py:159
↓ 1 callersFunctionrollout_single
(rollout_engine, tokenizer, messages, tools, max_turns=3, max_new_tokens=256, thinking_ratio=0.5, device="cuda
trainer/train_agent.py:98
↓ 1 callersFunctionrun_case
(prompt, tools, args, model=None, tokenizer=None, client=None)
scripts/eval_toolcall.py:177
↓ 1 callersFunctionsave_lora
(model, path)
model/model_lora.py:45
↓ 1 callersFunctionsetup_seed
(seed)
scripts/web_demo.py:302
↓ 1 callersFunctiontrain_tokenizer
(data_path, tokenizer_dir, vocab_size, special_tokens_num=SPECIAL_TOKENS_NUM)
trainer/train_tokenizer.py:24
↓ 1 callersFunctionvalidate_gt_in_text
(text, gt_list)
trainer/train_agent.py:183
Method__getitem__
(self, index)
dataset/lm_dataset.py:47
Method__getitem__
(self, index)
dataset/lm_dataset.py:106
Method__getitem__
(self, index)
dataset/lm_dataset.py:135
Method__getitem__
(self, index)
dataset/lm_dataset.py:217
Method__getitem__
(self, index)
dataset/lm_dataset.py:249
Method__init__
(self, data_path, tokenizer, max_length=512)
dataset/lm_dataset.py:38
Method__init__
(self, file_path, tokenizer, max_length=4096)
dataset/lm_dataset.py:123
Method__init__
(self, jsonl_path, tokenizer, max_length=1024, thinking_ratio=0.5)
dataset/lm_dataset.py:196
Method__init__
(self, jsonl_path, tokenizer, max_length=1024)
dataset/lm_dataset.py:227
Method__init__
(self, in_features, out_features, rank)
model/model_lora.py:7
Method__init__
(self, hidden_size=768, num_hidden_layers=8, use_moe=False, **kwargs)
model/model_minimind.py:12
Method__init__
(self, config: MiniMindConfig)
model/model_minimind.py:92
Method__init__
(self, config: MiniMindConfig, intermediate_size: int = None)
model/model_minimind.py:137
Method__init__
(self, config: MiniMindConfig)
model/model_minimind.py:149
Method__init__
(self, layer_id: int, config: MiniMindConfig)
model/model_minimind.py:179
Method__init__
(self, config: MiniMindConfig)
model/model_minimind.py:197
Method__init__
(self, config: MiniMindConfig = None)
model/model_minimind.py:237
Method__init__
(self, tokenizer, queue)
scripts/serve_openai_api.py:72
Method__init__
(self, params)
trainer/train_ppo.py:38
Method__init__
(self, policy_model: torch.nn.Module, tokenizer, device: str = "cuda", autocast_ctx=None)
trainer/rollout_engine.py:65
next →1–100 of 142, ranked by callers