模型发布
社区用户发现疑似 Kimi Linear 48B A3B 模型并分享实测
Reddit r/LocalLLaMA 用户发现一款名为 Kimi Linear 48B A3B 的模型,48B 参数、…
2026.07.26 · 周日约 2 分钟阅读
近日,Reddit 社区 r/LocalLLaMA 用户发帖称注意到一款名为「Kimi Linear 48B A3B」的模型。该模型来自月之暗面(Moonshot AI)旗下 Kimi 系列,标称为 48B 参数、采用 MOE 架构(active 参数量约 3B),并支持 100 万 token 的上下文窗口。原帖作者表示,该模型推理速度明显快于 Qwen 3.6 35B,是其一直期待的「长上下文 + MOE」组合。
社区初步实测情况
原帖作者对模型进行了简单测试,整体感受包括:
- 输出倾向「最小可行答复」:面对提问时倾向于给出尽量短的结果,需要用户额外追加「detail」等指令才能获得更详尽内容。
- 生成 meme 类配图效果尚可:在默认提示下生成的图像不算差,但内容深度有限。
- 前端代码能力突出:能够生成结构良好、动画效果不错的网页代码片段。
- 主观「违和感」:作者形容模型表现「有点不对劲(something off with its brain)」,在某些任务上逻辑连贯性不足。
速度与架构信息
根据帖子描述,48B 总参数 + MOE 的组合在长上下文场景下速度优势明显,与 Qwen 3.6 35B 相比体感更快,符合 MOE 模型在激活参数较小、显存占用可控情况下的预期表现。但帖子未给出具体的 tokens/s、显存占用或 benchmark 数据。
社区关注与待验证信息
原帖作者同时提出了几个开放性问题:模型能否通过微调(fine-tune)改善输出过简的倾向?是否有其他用户尝试过并取得更好效果?截至目前,相关信息仅来源于个别用户的本地实测,尚未见到 Moonshot 官方的发布说明、模型卡或技术博客对该型号的确认,因此模型规格、训练细节、能力边界仍有待进一步核实。
