Files
papers/zen-quantization.pdf
T
Hanzo Dev e0338d3b9f Honest provenance: family-wide non-media paper rewrite/withdraw
The non-media zen paper corpus fabricated a homegrown "Zen MoDE (Mixture of
Distilled Experts)" architecture + inflated benchmarks for what are off-the-shelf
forks. Rewrite/withdraw all 65 to be honest (companion to the media PR #3).

Rewritten (~45) to attribute the REAL upstream + license, drop "Zen MoDE" +
fabricated benchmarks:
- Flagship LLMs (zen-base/pro/family-overview/3-nano) -> Qwen3-8B (false 72B/0.6B corrected)
- Multimodal (zen3-omni/3-vl/vl) -> Qwen3-Omni / Qwen3-VL (false 72B -> ~31B MoE)
- Retrieval/safety: zen3-embedding/reranker -> Qwen3-Embedding/Reranker;
  zen3-guard -> IBM Granite Guardian; zen-guard-gen -> Qwen2.5-7B;
  zen-guard-stream -> Qwen2.5-3B (Qwen Research License = NON-commercial; flagged)
- Speech/dub: zen-scribe -> Qwen3-ASR; zen-voice-clone -> Qwen3-TTS;
  zen-dub -> Qwen3-TTS + MuseTalk; zen-dub-live/zen-live -> Qwen3-Omni
- Coder: zen-coder -> Qwen-Coder (deleted fake "Zen Agentic Dataset"); zen5 -> DeepSeek-V4-Flash
- Domain (legal/financial/medical) -> Qwen3-8B finetunes (fabricated benchmarks dropped)
- zen-designer-instruct/thinking -> Qwen3-VL-235B-A22B (verified real repos)
- Method/arch papers -> stripped "Zen MoDE" + phantom 480B/1T; techniques kept; tables marked illustrative

Withdrawn (11; no backing model / fabricated frontier scale): zen-max (480B),
the entire zen4-* generation (zen4/-mini/-pro/-max/-ultra/-thinking/-coder/
-coder-flash/-coder-pro), zen-reasoning.

INDEX.md (-> 59 papers) and PAPER_TIMELINE.md updated.

Co-authored-by: Hanzo Dev <dev@hanzo.ai>
2026-06-17 10:34:07 -07:00

197 KiB