Qwen3 finetune recipes - #975
Conversation
Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com>
Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com>
Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com>
Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com>
Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com>
|
/ok to test d0ecaf0 |
| return _qwen3_finetune_common(**combined_kwargs) | ||
|
|
||
|
|
||
| def _qwen3_finetune_common( |
There was a problem hiding this comment.
how is finetune common different from common? do we need 2 of them? @cuichenx as well
There was a problem hiding this comment.
i find it easier to read when they're split up. otherwise the user has to keep track of branching between pretraining vs sft vs peft across parallelisms, lr, dataset, and tokenizers. in addition, the finetuning recipe configs will have a lot of code in common, at least based on https://github.com/NVIDIA-NeMo/NeMo/blob/main/nemo/collections/llm/recipes/finetune_default.py
if anything, having _qwen3_sft_common and _qwen3_peft_common helpers will make the split even more obvious to users/developers. wdyt?
There was a problem hiding this comment.
i think it makes sense to separate finetune and pretrain. the data config, checkpoint config and tokenizer are all different. i think it even makes sense to have a common finetune helper for all models
Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com>
|
/ok to test 37e0a2f |
Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com>
|
/ok to test 8bb57ab |
* qwen3 finetuning configs Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetuning configs Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetune Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetune recipes Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * updates Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * revert changes to gpt step Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * address feedback Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * add load dir Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> --------- Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> Signed-off-by: NeMo Bot <nemo-bot@nvidia.com>
* qwen3 finetuning configs * qwen3 finetuning configs * qwen3 finetune * qwen3 finetune recipes * updates * revert changes to gpt step * address feedback * add load dir --------- Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> Signed-off-by: NeMo Bot <nemo-bot@nvidia.com> Co-authored-by: Ananth Subramaniam <ansubramania@nvidia.com>
* qwen3 finetuning configs Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetuning configs Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetune Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetune recipes Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * updates Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * revert changes to gpt step Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * address feedback Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * add load dir Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> --------- Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> Signed-off-by: Paul Gibbons <pgibbons@nvidia.com>
* qwen3 finetuning configs Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetuning configs Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetune Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * qwen3 finetune recipes Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * updates Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * revert changes to gpt step Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * address feedback Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> * add load dir Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> --------- Signed-off-by: Ananth Subramaniam <ansubramania@nvidia.com> Signed-off-by: mollys <mollys@mollys.nvidia.com>
Import the pretrained checkpoints using AutoBridge: https://github.com/NVIDIA-NeMo/Megatron-Bridge/blob/main/examples/conversion/convert_checkpoints.py
In the user train script, import qwen3 finetuning configs + specify paths to pretrained checkpoints from step 1 to begin finetuning
train script: https://gist.github.com/ananthsub/69139c3a8e30f57b4aa09eef422559cb