712097e26b9c047658297d98ec2a2ae75351e9ad
Clona la receta exacta de RedHatAI/Qwen3.6-35B-A3B-NVFP4 (QuantizationModifier targets=Linear scheme=NVFP4, ignore list identica) sobre el checkpoint mergeado de Fase 4. Diferencia obligatoria: calibra con una muestra de data/train.jsonl (chat template de produccion) en vez de ultrachat_200k. moe_calibrate_all_experts=True para cubrir los 256 expertos ruteados. Reinyecta MTP via save_mtp_tensors_to_checkpoint y deja que save_pretrained separe vision a su propio shard. Verificaciones automaticas: quantization_config.format, conteo de tensores MTP/vision, muestra sin NaN/Inf tras des-cuantizar, chat_template.jinja de produccion preservado.
Description
No description provided
465 MiB
Languages
Python
92.8%
Jinja
7.2%