DeepSeek V4 Flash 上线 Together AI,强化编程与智能体能力
Together AI 在 X 平台宣布上线 DeepSeek V4 Flash,主打编程、工具调用与可调推理档位,并引…
Together AI 在 X 平台宣布,已在其推理服务中上线 DeepSeek V4 Flash 模型,重点面向代码生成、长程智能体与高效率推理场景。这是 DeepSeek 新一代「Flash」档位模型首次在主流海外推理平台开放 API 接入。
编程能力全面增强
据 Together AI 公布的功能列表,DeepSeek V4 Flash 在三类编程场景上做了强化:
- 终端(terminal)侧的脚本与命令生成
- 仓库级(repository)任务,跨文件的理解与修改
- 全栈(full-stack)任务,覆盖前后端多语言开发
Together AI 强调,这些改进面向实际工程场景,而非单纯的代码补全 benchmark。
面向长程智能体的工具调用
V4 Flash 加入了更强的工具使用(tool use)与自动化能力,目标用例是「长跑型」(long-running)智能体。Together AI 表示,模型可以在多轮调用、外部工具、文件操作等链路中保持更稳定的行为,便于构建需要持续执行任务的 AI agent。
可调推理档位
平台开放了三个推理强度档位:
- low:低开销、快速响应
- high:常规复杂任务
- max:最高推理强度
开发者可根据任务难度与延迟要求,自行选择合适的档位,以平衡成本与质量。
DSpark 推测解码
V4 Flash 引入了 Together AI 自研的 DSpark 推测解码(speculative decoding)方案,用于加速生成。该技术在不改变模型输出的前提下,用更小的草稿模型预生成 token,再由目标模型批量验证,从而降低端到端推理时延。该功能由 Together AI 推理栈原生提供,调用方无需额外配置。
现状与限制
截至发稿,Together AI 仅公布了上述功能要点,尚未披露 DeepSeek V4 Flash 的具体参数量、上下文长度、官方 benchmark 成绩或定价细节,也未给出 DeepSeek 官方关于 V4 系列的正式发布说明。开发者如需进一步参数与能力对比,仍需等待 DeepSeek 官方渠道的后续披露。
