桃子桃子快讯
返回首页
开源

用户发现 Ornith 1.5 35B GGUF 权重文件被静默替换

Reddit 用户通过 diff 对比发现,Ornith 1.5 35B 的 GGUF 量化文件在 8 月 24 日被更…

2026.08.29 · 周六3 分钟阅读

近日,Reddit r/LocalLLaMA 板块用户 miki4242 在对比本地缓存与 Hugging Face 仓库中的 Ornith 1.5 35B(A3B 架构)GGUF 文件时发现,官方仓库于 8 月 24 日的一次「更新」并非简单的重新上传,而是底层权重发生了实质性变化。由于文件大小只相差数百字节,这一变更在社区中几乎无人察觉。

实际发生的变化

用户在从 Btrfs 备份中取出旧版快照后,对 Q4_K_M 量化版本进行了二进制 diff,主要发现以下三点不同:

  • 权重本身被替换:从首个字节起,原始 tensor 数据就与旧版不同,并非同一量化的「换皮」重传。
  • 重要性矩阵 / 校准数据更新:GGUF 元数据中仍残留作者机器路径,已从类似 35b-4000 改为 ornith-1.5-35b,与旧文件 general.version = "4000"general.finetune = "35b" 字段被移除相对应。
  • 标签信息清理size_label"256x2.6B" 修正为 "35B",并补全了 licensetagsbasename 等字段。

保持不变的部分

尽管量化产物发生了变动,模型的结构性参数完全一致,包括:

  • 架构:qwen35moe
  • tokenizer:相同的 248k 词表
  • file_type 与专家数量
  • 上下文长度

换言之,更新属于同一模型家族内的重新量化,使用了不同的校准 checkpoint,并重新整理了元数据标签。

社区疑问与后续

帖主表示,本次更新是否与近期社区中讨论的「随机 MTP head」问题修复有关尚不确定。由于没有官方说明,仅有的 commit 信息也是无意义的 Upload <file> with huggingface_hub,社区难以判断此次重发的实际目的:是改善生成质量,还是单纯的元数据清理。帖主呼吁其他下载过该模型的读者交流实测体验,并提醒:本次对比基于官方 ornith-ai 仓库,通过第三方镜像拉取的文件可能本就存在差异。

值得一提的是,该用户依靠 Btrfs 快照才得以保存旧版本进行对比,并调侃称 hf prune 虽好用,但确实会把旧文件「剪掉」。

信源