开源
TielCoder 推出 22GB 4-bit 量化编码模型,宣称对标 Opus 4.6 中等推理档
Reddit 用户 peculiar-ragdoll 发布 TielCoder-35B-A3B 的 GGUF/MLX 量…
2026.08.24 · 周一约 3 分钟阅读
近日,Reddit r/LocalLLaMA 社区用户 peculiar-ragdoll 发布了一款面向本地部署的编码大模型 TielCoder-35B-A3B,提供 4-bit 量化的 GGUF 与 MLX 版本。该项目基于 Qwen3 架构的 35B-A3B 混合专家(MoE)模型,在 Ornith-1.5 微调权重之上叠加代码加权的 importance matrix(imatrix)动态量化,并对聊天模板做了面向智能体编程的 token 效率优化。
核心规格
- 基础架构:Qwen3 系列 35B-A3B MoE,每次推理激活约 30 亿参数
- 量化精度:4-bit,GGUF 版本约 22GB,可在中端消费级硬件上运行
- 派生版本:GGUF(huggingface.co/peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF)与 MLX oQ4e(huggingface.co/peculiar-ragdoll/Tiel-Coder-35B-A3B-MLX-oQ4e)
性能声明
发布者声称,在近期一批真实代码仓库 issue 的端到端修复评测中,TielCoder 是其在正确性与响应速度上综合表现最稳定的 35B-A3B 编码模型,号称可对标 Claude Opus 4.6 的 medium 推理档,并优于此前被关注过的 KAT-Coder、Nail 等同类模型。需要指出的是,上述结论来自发布者个人基准测试,未提供可复现的测试集、评分脚本与统计方法。
定位与背景
TielCoder 并非全新的基础模型,而是"微调 + 量化 + 推理模板"组合的工程化再发布。对于希望在本地或边缘设备上获得较强代码生成与 agentic coding 能力的开发者来说,它提供了一个相对轻量、即开即用的选项;但若关注严格意义上的 SOTA 对比,仍需等待第三方独立基准(如 LiveCodeBench、SWE-Bench)给出验证数据。
获取方式
- Hugging Face GGUF:peculiar-ragdoll/Tiel-Coder-35B-A3B-GGUF
- Hugging Face MLX oQ4e:peculiar-ragdoll/Tiel-Coder-35B-A3B-MLX-oQ4e
社区讨论与下载链接详见 r/LocalLLaMA 原帖。
