微调的各种问题 #40
Replies: 22 comments 16 replies
|
lora微调后的模型,怎样通过vllm部署调用? |
|
128k微调大概需要多少A100 |
|
lora微调的时候,{'loss': 0.0, 'grad_norm': 0.0, 'learning_rate': 0.0004983333333333334, 'epoch': 0.06} loss和grad_norm一直都是0 |
|
你好,如何使用微调后的模型进行对话 |
|
这个错是什么原因呢? python finetune.py data/AdvertiseGen/ /mnt/workspace/panyun/models/THUDM/glm-4-9b-chat configs/lora.yaml |
|
8*80GA00,8k文本长度lora能调动吗?ds zero2或者zero3 |
|
想问一下GLM-4-9B模型是否支持在4张T4卡共64G显存配置的服务器上实现微调,感谢,因为包括我使用多模态模型还有微调时都会出现运行错误 |
|
请问微调之后模型输出停不下来,在后半段会一直重复某段话反复输出,有什么问题影响到吗? |
|
请问单卡单机运行GLM4v的lora时,如何让gpu为指定的cuda而不是cuda:0呢 |
|
想询问下GLM4和GLM2、3版本的性能差异来源。 |
|
|
微调过后,训练样本的问题回答的很好,但是通用能力回答的问题都很简短。这个如何提高? |
|
模型推理正常,LORA微调训练阶段正常,到评估时候报错KeyError: 'loss',详情如下,问题发生时间2024年12月9日,transformer版本4.47.0 |
|
我们已经更新了微调代码,并支持使用Llama Factory进行微调,请使用最新版本transformers |










我们已经更新了微调代码,并支持使用Llama Factory进行微调,请使用最新版本transformers