新闻
GPT-6 luna VS Deepseek 4
1 分钟阅读
GPT-6 luna VS Deepseek 4.1 flash 原帖总结如下: 普通 API 调用:Luna 更划算。 现在 Luna 的输入、输出单价甚至已经低于 DeepSeek V4.1 Flash 的最低空闲时段价格。 大量重复上下文 / Cache:DeepSeek 更划算 。 例如 Agent 每次都带很长的固定代码、论文资料、系统提示词,DeepSeek 的缓存价格优势很明显。 能力:DeepSeek 4.1 Flash 略强,但差距不大。 独立测试大约是 39 vs 37,不是一个明显跨档次的差距。 速度:DeepSeek 更快。 如果特别看重大量并发、快速生成,DeepSeek 有优势。 但是 DeepSeek 有一个明显优势:缓存 DeepSeek 的缓存命中价格大约只有 Luna 的:30%~60% 如果你的应用反复发送大量相同的上下文,那么 DeepSeek 可能依然更省。DeepSeek 官方也明确说明,其上下文缓存默认启用,重复前缀可以计入缓存命中。 还有一个非常重要的例外:超长上下文 这是我之前回答中没有强调的地方。 GPT-6 Luna 如果一次请求的输入超过 272K tokens,整个请求会进入长上下文定价: OpenAI 官方明确规定,超过 272K 输入 tokens 后,输入/cache 变为 2 倍,输出变为 1.5 倍。 这时候与 DeepSeek 空闲价比较: Luna $0.20 输入 vs DeepSeek $0.15 Luna $0.75 输出 vs DeepSeek $0.60 于是DeepSeek 反而更便宜。 一句话版 常规上下文:GPT-6 Luna 更便宜。 大量 Cache 命中:DeepSeek V4.1 Flash 更便宜。 超长上下文(Luna >272K 输入):DeepSeek 空闲期通常也更便宜。 via: