行业动态
Qwen 3.8 27B 自托管对 Claude Opus 4.6:第三方编码任务对比引关注
第三方机构用同一 Three.js 编码任务测试 Qwen 3.8 27B 自托管与 Claude Opus 4.6,均…
2026.08.15 · 周六约 2 分钟阅读
第三方测试机构 TestingCatalog(旗下 AI/ML API 团队)在 X 平台发布了一组对比结果:在同一编码任务下,自托管的 Qwen 3.8 27B 模型与 Claude Opus 4.6 均顺利完成了完整产出,但运行成本差距明显。
测试任务
测试要求两个模型各自生成一个独立的 Three.js 文件,渲染一座沉没的亚特兰蒂斯城场景,并包含一段 20 秒的脚本化相机飞行路径。这是一项同时考察代码生成、几何建模与时序控制能力的中等复杂度任务。
完成情况与成本
- 任务完成度:两款模型都成功跑完了全部相机路径,输出了可用的 Three.js 代码文件。
- 运行成本:自托管的 Qwen 3.8 27B 完全免费,只需承担本地算力开销;调用 Claude Opus 4.6 的 API 则需要 0.21 美元。
- 质量判断:原帖以「Who's winning?」收尾,测试方尚未公布画面质量、代码可读性或运行流畅度等维度的对比细节。
编辑观察
该测试由 TestingCatalog 独立进行,并非阿里或 Anthropic 的官方发布,因此属于第三方参考而非权威结论。在没有逐项评分、对照代码或截图的情况下,目前可量化的信息仅停留在「均能完成 + 成本悬殊」这一层。对于正在权衡自托管开源权重与闭源 API 之间性价比的开发者来说,这条结论可以作为一个起点,但完整判断仍需等待后续更详细的评测数据。
