Files
Hanzo Dev a0513a5eb4 Initial zen4-ultra training pipeline
QLoRA fine-tuning for Kimi K2.5 (1.04T MoE) with gate/router unfreezing.
Standard abliteration fails on MoE — backprop through router instead.

- train_zen4_ultra.py: SFT + DPO training modes
- merge_and_upload.py: Merge LoRA adapters into base
- generate_compliance_data.py: Generate compliance training data
- app.py: HuggingFace Spaces Gradio app
- data/: Identity training data (736 examples)
2026-02-23 00:39:44 -08:00
..