mirror of
https://github.com/xming521/WeClone.git
synced 2026-08-29 02:10:55 +08:00
b8747edf27
- 新增 QuantizationArgs 配置类,与 LLaMA-Factory QuantizationArguments 对齐 - 移除 load_in_4bit/load_in_8bit(由 quantization_bit 内部处理) - 新增 quantization_method 支持多种量化后端(bnb, gptq, awq 等) - 修复 dict_to_argv 跳过 None 值,避免 HfArgumentParser 报错 - 使用 exclude_none=True 防止空字段传递给 run_exp() - 训练和推理时自动展平嵌套的量化配置