桃子桃子快讯
返回首页
开源

TielCoder 推出 22GB 4-bit 量化编码模型,宣称对标 Opus 4.6 中等推理档

Reddit 用户 peculiar-ragdoll 发布 TielCoder-35B-A3B 的 GGUF/MLX 量…

2026.08.24 · 周一3 分钟阅读

近日,Reddit r/LocalLLaMA 社区用户 peculiar-ragdoll 发布了一款面向本地部署的编码大模型 TielCoder-35B-A3B,提供 4-bit 量化的 GGUF 与 MLX 版本。该项目基于 Qwen3 架构的 35B-A3B 混合专家(MoE)模型,在 Ornith-1.5 微调权重之上叠加代码加权的 importance matrix(imatrix)动态量化,并对聊天模板做了面向智能体编程的 token 效率优化。

核心规格

  • 基础架构:Qwen3 系列 35B-A3B MoE,每次推理激活约 30 亿参数
  • 量化精度:4-bit,GGUF 版本约 22GB,可在中端消费级硬件上运行
  • 派生版本:GGUF(huggingface.co/peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF)与 MLX oQ4e(huggingface.co/peculiar-ragdoll/Tiel-Coder-35B-A3B-MLX-oQ4e)

性能声明

发布者声称,在近期一批真实代码仓库 issue 的端到端修复评测中,TielCoder 是其在正确性与响应速度上综合表现最稳定的 35B-A3B 编码模型,号称可对标 Claude Opus 4.6 的 medium 推理档,并优于此前被关注过的 KAT-Coder、Nail 等同类模型。需要指出的是,上述结论来自发布者个人基准测试,未提供可复现的测试集、评分脚本与统计方法。

定位与背景

TielCoder 并非全新的基础模型,而是"微调 + 量化 + 推理模板"组合的工程化再发布。对于希望在本地或边缘设备上获得较强代码生成与 agentic coding 能力的开发者来说,它提供了一个相对轻量、即开即用的选项;但若关注严格意义上的 SOTA 对比,仍需等待第三方独立基准(如 LiveCodeBench、SWE-Bench)给出验证数据。

获取方式

  • Hugging Face GGUF:peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF
  • Hugging Face MLX oQ4e:peculiar-ragdoll/Tiel-Coder-35B-A3B-MLX-oQ4e

社区讨论与下载链接详见 r/LocalLLaMA 原帖。

信源